FSGUI特性
音视频接入
降低用户的接入门槛
安全性、高并发、可靠性、动态扩展性、易用性、接口完备性、功能性
简单易用的呼叫中心及调度指挥中间件
通信产品
呼入呼出控制、IVR、智能外呼、智能客服、视频客服、智能视频客服、智能质检、黑名单、区域策略、时间策略、排队机、并联录音质检、满意度调查、报工号、座席状态管理
面向有自己定制及源码需求的企业
培训及服务
提供基于FreeSWITCH、OpenSIPS、Kamailio的基础使用培训及相关架构等服务
Nway Audio AI V2.7.3 新增能力
纯 CPU 的 Nway ASR & TTS 服务
在 纯 CPU 架构不变 的前提下,重点增强了识别速度、精度以及真实通话场景的可用性。
让 ASR 在真实业务里更快、更准、更像“人类对话”。
nasr-server-q
速度优先面向「速度优先」场景的 ASR 服务端版本。只要能更快完成识别,就值得。
- 纯 CPU 运行,极简部署
- 更激进的推理参数与并发策略
- 极高的吞吐量,单机可处理更多并发请求
大批量离线录音转写、对实时性要求极高的系统、能接受“略微降低精度,但必须更快”的业务。
nasr-server-ss
精度优先面向「识别质量优先」的 ASR 服务端版本。慢一点没关系,别识别错。
- 纯 CPU 运行,稳如泰山
- 使用更高质量 / 更精细的 ASR 模型
- 对真实口语、断句更友好,结果更稳
通话质检、金融/客服录音审计、对数字/人名/长句准确率要求较高的核心场景。
🎧 nasr-client-vad
双声道分离 + 切片识别 + 对话化输出
它解决了什么问题?
现实中的通话录音通常是一个长达几分钟的双声道 WAV 文件(左声道:客户,右声道:客服)。如果不加处理直接识别,结果会是一堆没有标点、混杂在一起的流水账文本。
nasr-client-vad 做了什么?
它在客户端侧完成了完整的“对话化预处理”流程:
- 自动识别双声道音频并拆分左右声道
- 基于 WebRTC VAD(语音活动检测)智能切分语音段
- 分别调用 ASR 服务进行并行识别
- 按声道输出天然具备
说话方、时间戳、对应文本的结构化结果
👉 输出结果天然就是「对话模式」,可以直接用于通话质检、行为分析与下游 LLM 处理!
{
"channel": "right",
"start_time": 12.48,
"end_time": 18.32,
"text": "您好,这里是银行信用卡中心。"
}
客服 (12.48s ~ 18.32s):
您好,这里是银行信用卡中心。
实时语音通信与智能体对接
Na_stream:全双工 · 低延迟 · 可打断 · 实时流 · 高质量
完美支持传统 PSTN、WebRTC 与 VoIP,为电话客服、智能外呼、
语音助手等场景打造真实的双向语音对话体验。
一次实时通话是如何“流动”的?
在一个完整的语音对话系统中,智能体需要端到端的优化才能达到最佳效果。通过 Na_stream,数据链路实现了低延迟的闭环:
- 1 用户通过电话或 App 发起通话
- 2 语音被底层系统 采集、编码并发送
- 3 Na_stream 实时无缝接入音频流
- 4 智能体进行 ASR(语音识别)→ LLM 处理 → TTS 合成
- 5 生成语音 实时回传 给用户播放
电话应用的“默认规则”
1. 采样率与声道
传统电话通常为 8kHz 单声道(窄带),高清语音为 16kHz 单声道(宽带)。为提升 ASR 效果,建议统一由 Na_stream 转换为 16kHz PCM 供智能体处理。
2. 常见编码格式 (Codec)
- G.711 (PCMU/PCMA):电话系统最常见,实现简单,兼容性极佳。
- Opus:WebRTC/移动端主流,抗丢包能力强,音质更优。
Na_stream:强大的“媒体桥接层”
1. 音频标准化
无论底层是标准 RTP (传统电话) 还是带加密防抖的 WebRTC,Na_stream 都能接收并进行转码、重采样,统一转换为智能体可识别的格式。
2. 双向流式对接
- 上行:按 20ms 切片发送音频,附带会话ID、时间戳、序号等元信息。
- 下行:TTS 音频实时返回,以 20ms 切片发送,支持边生成边播放,极大降低等待时间。
3. 毫秒级打断 (Barge-in)
电话智能体的关键体验。当检测到用户说话时,立即停止 TTS 播放,瞬间切换至 ASR 模式,保证对话如真人般自然流畅。
纯 CPU 高并发实时语音清洗引擎
Nway ClearVoice Core™
让机器真正听清世界
告别昂贵 GPU 与低并发瓶颈,专为“真实业务场景”打造,
为 ASR 与 AI 智能体提供最纯净的第一道语音入口。
为什么语音系统总是“不够聪明”?
客服通话、车载或智能设备交互常面临:环境噪声、多人说话干扰、语音断裂及长时间静音。这些问题会在链路中被逐层放大:
- 传输层:无效噪音导致带宽浪费、延迟增加
- 硬件层:CPU/GPU 资源被大量无效音频消耗
- 软件层:脏数据导致 ASR 频频误判、语义偏移
- 决策层:错误理解最终导致 AI 给出错误响应
Nway ClearVoice Core™ 是什么?
我们不追求脱离实际的“实验室音频优化”,而是直击真实工程痛点。这是一套为你的业务量身定做的智能语音前处理系统:
基于大量真实业务语音样本的持续训练与调优,提供真正“工程可用”的高并发清洗能力。
三大核心能力
1. 高性能纯 CPU 语音清洗
彻底摆脱昂贵的 GPU 算力依赖!纯 CPU 即可实现实时降噪、人声增强、主说话人突出。部署极简,高并发稳定运行,完美适配中心服务器与边缘 IoT 设备。
2. 智能理解前置优化
超越传统的简单滤噪,专为 ASR / AI 大模型深度优化:提高语音可懂度、保留完整语音结构、减少识别歧义,让后端的智能体“听得更准、懂得更深”。
3. 真实场景训练驱动
告别通用模型的水土不服!底层算法基于客服录音、VoIP 通话、复杂车内/室内噪声等海量真实业务数据持续进化,专为复杂的落地场景量身定制。
带来的核心价值
-
提升识别准确率
提供更干净的人声,为 ASR 引擎输出最稳定的高质量输入流。
-
大幅降低系统成本
剔除大段静音与无效噪音,显著降低网络带宽与后端计算开销。
-
极致提升用户体验
交互语音更自然,系统响应更准确,打造如真人般顺畅的对话。
广泛的应用场景
它是下一代智能语音系统的 第一道智能入口。
Nway IP Process (NIP) 再升级
非侵入式安全防护、实时通话甄别与全链路数据赋能
从内核防护到全链路媒体处理。理论上支持所有标准 SIP 应用,
不局限于 VOS、FreeSWITCH、RtpEngine、Asterisk 及各类商业语音系统。
从 Protect 到 Process,再到实时洞察
NIP 是一套面向现代语音通信(VoIP)基础设施的高性能、非侵入式、模块化解决方案。 它在操作系统内核层面提供网络数据包的实时捕获、控制与处理能力,无需对现有 VoIP 系统进行改造, 保证系统纯净性与稳定性。作为基础能力,NIP能实时对于来往的SIP包进行实时的安全防护;同时,NIP 已从“安全防护”延伸到“媒体处理与实时分析”,可在通话接通早期完成静音检测、TTS 合成音识别,并在整个会话过程中基于 VAD 进行分段录音,为实时质检、座席助手与智能分析提供连续数据输入。
- 安全是基础:不管哪个版本的NIP,我们都保证它实时进行专门的SIP安全防护。
- 彻底的性能解耦:软交换只负责信令,底层直接复制、处理并推送媒体数据,业务性能零损耗。
- 接通早期智能甄别:支持接通后前若干秒静音检测、TTS 合成音检测,快速识别无效接通,避免浪费话费与机器人资源。
- 全会话 VAD 分段录音:对整个通话过程按语音活动进行一段又一段的录音输出,更适合实时质检、座席助手、事件回放与增量分析。
- 标准化数据对接:可将 UDP 包封装为带 Call-ID 的 HEP 流,轻松对接 Homer、ASR、LLM Agent 或各类 AI 平台。
- 毫秒级实时性:RTP 包到达网卡瞬间即被捕获与推送,让 AI 风控、实时质检与业务辅助成为可能。
- 全链路黑盒监控:处于内核入口,捕获最原始交互信息,无惧上层应用差异,适合统一监控与审计。
功能场景扩展
纯安全防护网关
启用 nip_kmod + nip_ctl,最轻量模式,仅做防火墙,拦截恶意扫描、异常信令与骚扰呼叫。
接通前的回铃识别
启用 cpd ,最轻量模式回铃检测,实现对于空号、正在通话中、忙、不在服务区等快速检测并挂断。
接通后智能甄别
启用 MUTE+TTS检测,在通话接通后的前若干秒内,对媒体流进行静音检测、TTS 合成音识别,快速判断空接、机器人播报、无效振铃后接通等场景,减少无效计费与线路占用。
大规模录音与 VAD 分段数据输出
启用 VAD,不仅可生成传统 WAV 录音满足合规存档,还可基于 VAD 对整段会话持续切分输出语音片段,便于实时质检、座席助手与 AI 增量处理。
智能语音分析与全链路监控(HEP 模式)
启用 HEP,NIP 将 SIP 信令和 RTP 媒体流通过 HEP 实时推送给 Homer 平台、ASR 引擎或实时分析系统,无需改造软交换,即可低成本实现实时 AI 质检、会话洞察与全链路监控。
四大核心组件解析
nip_kmod.ko
内核网络引擎(心脏):在内核层无感抓包、实时拦截恶意流量,并将数据高效写入共享内存(Ring Buffer),为后续媒体分析提供统一入口。
nip_ctl
指挥控制中心(大脑):负责动态下发黑白名单策略(IP、UA、号码等),策略即时生效,无需重启系统,并统一管理处理规则与输出策略。
nip_pcapd
通用抓包服务(眼睛):用于故障排查,相当于一个可被精确控制的 tcpdump,只抓取关心的信令与通话数据,提升排障效率。
nip_recdd
智能录音与分发引擎:负责 SIP 解析、状态管理、RTP 录音与媒体分发;支持接通初期静音/TTS 检测、全会话 VAD 分段录音,以及 HEP3 协议实时镜像推送。
性能巅峰与硬件规划
| 并发目标 | CPU 建议 | 内存建议 | 网卡建议(关键) | 存储建议 |
|---|---|---|---|---|
| 8,000 路 | 16 核(如 Xeon Silver 4410Y) | 64 GB | 双口 10G/25G | NVMe SSD(用于缓冲) |
| 30,000 路 | 64 核(如 AMD EPYC 9354) | 256 GB | 双口 40G/100G | 高性能 NVMe RAID |
PRODUCT
宁卫产品大全
涵盖从底层通信中间件、呼叫中心平台到 AI 语音质检的完整产品矩阵,
为企业提供全方位的通信与信息化解决方案。
FSGUI呼叫中心中间件
自主研发的新一代呼叫平台,集成云呼叫、VOIP、PSTN、IMS、DID、IVR等,实现IP网络与传统通信语音完美结合。
八爪鱼呼叫平台
以电话服务为主要方式、结合业务系统数据提供全方位服务。可作为自动群呼、分布式、跨平台的呼叫中心综合系统。
宁卫通信运营平台
针对全国 400 电话或一号通研发的高效稳定综合管理平台,支持多租户呼入型客服呼叫中心(如10086/95xxx的号码服务)。
回铃音与空号检测
基于运营商线路回铃的检测算法模块,精准识别并拦截空号、忙音、关机、停机、欠费等状态,提高外呼效率。
语音机器人 & ASR/IVR
提供高度拟人化的语音对话机器人,结合语音识别 (ASR) 与智能 IVR 交互,实现自动化客户服务与智能外呼任务。
全场景智能语音质检
涵盖实时语音质检与离线录音质检,通过 AI 大模型深度分析通话内容、情绪与话术合规性,全面赋能业务审计。
宁卫语音短信平台
专为全国各类企事业单位研发的语音信息触达平台,支持批量或单个精准发送语音验证码及通知信息。
电子传真平台
基于运营商语音电路附加传真指令集,可成批量自动发送电子文档(如 .doc, .xls, .txt 等)至目标用户的传真机。
明辰私有云盘与备份
包含明辰网络共享盘(支持多平台权限管理)及明辰备份工具,支持定时自动或手工同步目录路径,保障企业数据资产安全。
更多定制化解决方案与服务
除核心通信产品外,我们还提供 VOIP-HA 高可用架构设计、防伪技术系统接入、以及 微信公众号系统深度定制集成 等多样化技术支撑,满足企业复杂业务需求。
市场领域
企事业音视频通信