preloader

FSGUI特性

音视频接入
降低用户的接入门槛

安全性、高并发、可靠性、动态扩展性、易用性、接口完备性、功能性

简单易用的呼叫中心及调度指挥中间件

通信产品

呼入呼出控制、IVR、智能外呼、智能客服、视频客服、智能视频客服、智能质检、黑名单、区域策略、时间策略、排队机、并联录音质检、满意度调查、报工号、座席状态管理

Video Thumbnail

面向有自己定制及源码需求的企业

培训及服务

提供基于FreeSWITCH、OpenSIPS、Kamailio的基础使用培训及相关架构等服务

Video Thumbnail

Nway Audio AI V2.7.3 新增能力

纯 CPU 的 Nway ASR & TTS 服务

纯 CPU 架构不变 的前提下,重点增强了识别速度、精度以及真实通话场景的可用性。
让 ASR 在真实业务里更快、更准、更像“人类对话”。

nasr-server-q

速度优先

面向「速度优先」场景的 ASR 服务端版本。只要能更快完成识别,就值得。

  • 纯 CPU 运行,极简部署
  • 更激进的推理参数与并发策略
  • 极高的吞吐量,单机可处理更多并发请求
适用场景:
大批量离线录音转写、对实时性要求极高的系统、能接受“略微降低精度,但必须更快”的业务。

nasr-server-ss

精度优先

面向「识别质量优先」的 ASR 服务端版本。慢一点没关系,别识别错。

  • 纯 CPU 运行,稳如泰山
  • 使用更高质量 / 更精细的 ASR 模型
  • 对真实口语、断句更友好,结果更稳
适用场景:
通话质检、金融/客服录音审计、对数字/人名/长句准确率要求较高的核心场景。
强烈推荐组件

🎧 nasr-client-vad

双声道分离 + 切片识别 + 对话化输出

它解决了什么问题?
现实中的通话录音通常是一个长达几分钟的双声道 WAV 文件(左声道:客户,右声道:客服)。如果不加处理直接识别,结果会是一堆没有标点、混杂在一起的流水账文本。

nasr-client-vad 做了什么?
它在客户端侧完成了完整的“对话化预处理”流程:

  • 自动识别双声道音频并拆分左右声道
  • 基于 WebRTC VAD(语音活动检测)智能切分语音段
  • 分别调用 ASR 服务进行并行识别
  • 按声道输出天然具备 说话方时间戳对应文本 的结构化结果

👉 输出结果天然就是「对话模式」,可以直接用于通话质检、行为分析与下游 LLM 处理!

典型识别结果片段
JSON
{
  "channel": "right",
  "start_time": 12.48,
  "end_time": 18.32,
  "text": "您好,这里是银行信用卡中心。"
}

业务层渲染后:
客服 (12.48s ~ 18.32s):
您好,这里是银行信用卡中心。

实时语音通信与智能体对接

Na_stream:全双工 · 低延迟 · 可打断 · 实时流 · 高质量

完美支持传统 PSTN、WebRTC 与 VoIP,为电话客服、智能外呼、
语音助手等场景打造真实的双向语音对话体验。

一次实时通话是如何“流动”的?

在一个完整的语音对话系统中,智能体需要端到端的优化才能达到最佳效果。通过 Na_stream,数据链路实现了低延迟的闭环:

  • 1 用户通过电话或 App 发起通话
  • 2 语音被底层系统 采集、编码并发送
  • 3 Na_stream 实时无缝接入音频流
  • 4 智能体进行 ASR(语音识别)→ LLM 处理 → TTS 合成
  • 5 生成语音 实时回传 给用户播放

电话应用的“默认规则”


1. 采样率与声道

传统电话通常为 8kHz 单声道(窄带),高清语音为 16kHz 单声道(宽带)。为提升 ASR 效果,建议统一由 Na_stream 转换为 16kHz PCM 供智能体处理。

2. 常见编码格式 (Codec)
  • G.711 (PCMU/PCMA):电话系统最常见,实现简单,兼容性极佳。
  • Opus:WebRTC/移动端主流,抗丢包能力强,音质更优。

Na_stream:强大的“媒体桥接层”

1. 音频标准化

无论底层是标准 RTP (传统电话) 还是带加密防抖的 WebRTC,Na_stream 都能接收并进行转码、重采样,统一转换为智能体可识别的格式

2. 双向流式对接

  • 上行:按 20ms 切片发送音频,附带会话ID、时间戳、序号等元信息。
  • 下行:TTS 音频实时返回,以 20ms 切片发送,支持边生成边播放,极大降低等待时间。

3. 毫秒级打断 (Barge-in)

电话智能体的关键体验。当检测到用户说话时,立即停止 TTS 播放,瞬间切换至 ASR 模式,保证对话如真人般自然流畅。

核心竞争力:电话交互对延迟极其敏感,Na_stream 确保从入端到出端的数据处理达到极致的低延迟标准。

纯 CPU 高并发实时语音清洗引擎

Nway ClearVoice Core™
让机器真正听清世界

告别昂贵 GPU 与低并发瓶颈,专为“真实业务场景”打造,
为 ASR 与 AI 智能体提供最纯净的第一道语音入口。

为什么语音系统总是“不够聪明”?

客服通话、车载或智能设备交互常面临:环境噪声、多人说话干扰、语音断裂长时间静音。这些问题会在链路中被逐层放大:

  • 传输层:无效噪音导致带宽浪费、延迟增加
  • 硬件层:CPU/GPU 资源被大量无效音频消耗
  • 软件层:脏数据导致 ASR 频频误判、语义偏移
  • 决策层:错误理解最终导致 AI 给出错误响应
恶性循环:识别错误 → 理解错误 → 决策错误 → 体验下降

Nway ClearVoice Core™ 是什么?

我们不追求脱离实际的“实验室音频优化”,而是直击真实工程痛点。这是一套为你的业务量身定做的智能语音前处理系统:

客服通话 真实录音 复杂噪声环境 多人干扰场景

基于大量真实业务语音样本的持续训练与调优,提供真正“工程可用”的高并发清洗能力。

三大核心能力

1. 高性能纯 CPU 语音清洗

彻底摆脱昂贵的 GPU 算力依赖!纯 CPU 即可实现实时降噪、人声增强、主说话人突出。部署极简,高并发稳定运行,完美适配中心服务器与边缘 IoT 设备。

2. 智能理解前置优化

超越传统的简单滤噪,专为 ASR / AI 大模型深度优化:提高语音可懂度、保留完整语音结构、减少识别歧义,让后端的智能体“听得更准、懂得更深”。

3. 真实场景训练驱动

告别通用模型的水土不服!底层算法基于客服录音、VoIP 通话、复杂车内/室内噪声等海量真实业务数据持续进化,专为复杂的落地场景量身定制。

带来的核心价值

  • 提升识别准确率

    提供更干净的人声,为 ASR 引擎输出最稳定的高质量输入流。

  • 大幅降低系统成本

    剔除大段静音与无效噪音,显著降低网络带宽与后端计算开销。

  • 极致提升用户体验

    交互语音更自然,系统响应更准确,打造如真人般顺畅的对话。

广泛的应用场景

呼叫中心
智能客服
车载语音
IoT设备
实时通信
语音数据处理
Nway ClearVoice Core™ 不是一个简单的“降噪工具”,
它是下一代智能语音系统的 第一道智能入口

Nway IP Process (NIP) 再升级

非侵入式安全防护、实时通话甄别与全链路数据赋能

从内核防护到全链路媒体处理。理论上支持所有标准 SIP 应用,
不局限于 VOS、FreeSWITCH、RtpEngine、Asterisk 及各类商业语音系统。

从 Protect 到 Process,再到实时洞察

NIP 是一套面向现代语音通信(VoIP)基础设施的高性能、非侵入式、模块化解决方案。 它在操作系统内核层面提供网络数据包的实时捕获、控制与处理能力,无需对现有 VoIP 系统进行改造, 保证系统纯净性与稳定性。作为基础能力,NIP能实时对于来往的SIP包进行实时的安全防护;同时,NIP 已从“安全防护”延伸到“媒体处理与实时分析”,可在通话接通早期完成静音检测、TTS 合成音识别,并在整个会话过程中基于 VAD 进行分段录音,为实时质检、座席助手与智能分析提供连续数据输入。

  • 安全是基础:不管哪个版本的NIP,我们都保证它实时进行专门的SIP安全防护。
  • 彻底的性能解耦:软交换只负责信令,底层直接复制、处理并推送媒体数据,业务性能零损耗。
  • 接通早期智能甄别:支持接通后前若干秒静音检测、TTS 合成音检测,快速识别无效接通,避免浪费话费与机器人资源。
  • 全会话 VAD 分段录音:对整个通话过程按语音活动进行一段又一段的录音输出,更适合实时质检、座席助手、事件回放与增量分析。
  • 标准化数据对接:可将 UDP 包封装为带 Call-ID 的 HEP 流,轻松对接 Homer、ASR、LLM Agent 或各类 AI 平台。
  • 毫秒级实时性:RTP 包到达网卡瞬间即被捕获与推送,让 AI 风控、实时质检与业务辅助成为可能。
  • 全链路黑盒监控:处于内核入口,捕获最原始交互信息,无惧上层应用差异,适合统一监控与审计。

功能场景扩展

纯安全防护网关

启用 nip_kmod + nip_ctl,最轻量模式,仅做防火墙,拦截恶意扫描、异常信令与骚扰呼叫。

接通前的回铃识别

启用 cpd ,最轻量模式回铃检测,实现对于空号、正在通话中、忙、不在服务区等快速检测并挂断。

接通后智能甄别

启用 MUTE+TTS检测,在通话接通后的前若干秒内,对媒体流进行静音检测、TTS 合成音识别,快速判断空接、机器人播报、无效振铃后接通等场景,减少无效计费与线路占用。

大规模录音与 VAD 分段数据输出

启用 VAD,不仅可生成传统 WAV 录音满足合规存档,还可基于 VAD 对整段会话持续切分输出语音片段,便于实时质检、座席助手与 AI 增量处理。

智能语音分析与全链路监控(HEP 模式)

启用 HEP,NIP 将 SIP 信令和 RTP 媒体流通过 HEP 实时推送给 Homer 平台、ASR 引擎或实时分析系统,无需改造软交换,即可低成本实现实时 AI 质检、会话洞察与全链路监控。

四大核心组件解析

nip_kmod.ko

内核网络引擎(心脏):在内核层无感抓包、实时拦截恶意流量,并将数据高效写入共享内存(Ring Buffer),为后续媒体分析提供统一入口。

nip_ctl

指挥控制中心(大脑):负责动态下发黑白名单策略(IP、UA、号码等),策略即时生效,无需重启系统,并统一管理处理规则与输出策略。

nip_pcapd

通用抓包服务(眼睛):用于故障排查,相当于一个可被精确控制的 tcpdump,只抓取关心的信令与通话数据,提升排障效率。

nip_recdd

智能录音与分发引擎:负责 SIP 解析、状态管理、RTP 录音与媒体分发;支持接通初期静音/TTS 检测、全会话 VAD 分段录音,以及 HEP3 协议实时镜像推送。

性能巅峰与硬件规划

并发目标 CPU 建议 内存建议 网卡建议(关键) 存储建议
8,000 路 16 核(如 Xeon Silver 4410Y) 64 GB 双口 10G/25G NVMe SSD(用于缓冲)
30,000 路 64 核(如 AMD EPYC 9354) 256 GB 双口 40G/100G 高性能 NVMe RAID
带宽预警: 开启 HEP 全量 RTP 推送意味着流量翻倍(原始流量 + 镜像流量)。若再叠加实时分析、VAD 分段输出等能力, 对网络 I/O、CPU 中断处理与缓冲队列都会提出更高要求。1 万路并发通话(双向音频)大约需要 1.6 Gbps 带宽, 加上镜像推送后约需 3.2 Gbps,因此,万兆网卡是起步配置

PRODUCT

宁卫产品大全

涵盖从底层通信中间件、呼叫中心平台到 AI 语音质检的完整产品矩阵,
为企业提供全方位的通信与信息化解决方案。

FSGUI呼叫中心中间件

自主研发的新一代呼叫平台,集成云呼叫、VOIP、PSTN、IMS、DID、IVR等,实现IP网络与传统通信语音完美结合。

八爪鱼呼叫平台

以电话服务为主要方式、结合业务系统数据提供全方位服务。可作为自动群呼、分布式、跨平台的呼叫中心综合系统。

宁卫通信运营平台

针对全国 400 电话或一号通研发的高效稳定综合管理平台,支持多租户呼入型客服呼叫中心(如10086/95xxx的号码服务)。

回铃音与空号检测

基于运营商线路回铃的检测算法模块,精准识别并拦截空号、忙音、关机、停机、欠费等状态,提高外呼效率。

语音机器人 & ASR/IVR

提供高度拟人化的语音对话机器人,结合语音识别 (ASR) 与智能 IVR 交互,实现自动化客户服务与智能外呼任务。

全场景智能语音质检

涵盖实时语音质检与离线录音质检,通过 AI 大模型深度分析通话内容、情绪与话术合规性,全面赋能业务审计。

宁卫语音短信平台

专为全国各类企事业单位研发的语音信息触达平台,支持批量或单个精准发送语音验证码及通知信息。

电子传真平台

基于运营商语音电路附加传真指令集,可成批量自动发送电子文档(如 .doc, .xls, .txt 等)至目标用户的传真机。

明辰私有云盘与备份

包含明辰网络共享盘(支持多平台权限管理)及明辰备份工具,支持定时自动或手工同步目录路径,保障企业数据资产安全。

更多定制化解决方案与服务

除核心通信产品外,我们还提供 VOIP-HA 高可用架构设计防伪技术系统接入、以及 微信公众号系统深度定制集成 等多样化技术支撑,满足企业复杂业务需求。

市场领域

企事业音视频通信

testimonials
testimonials