NovaSynth by Noveum
Noveum 推出的 NovaSynth 通过模拟真实 SIP 通话、LiveKit 音频流与文本聊天交互,对对话式 AI 智能体展开高强度压力测试,全面检验其在被打断、极端边界情况及对抗性攻击下的表现与鲁棒性。
Noveum 推出的 NovaSynth 通过模拟真实 SIP 通话、LiveKit 音频流与文本聊天交互,对对话式 AI 智能体展开高强度压力测试,全面检验其在被打断、极端边界情况及对抗性攻击下的表现与鲁棒性。
产品用途与官方定位
Noveum 旗下的 NovaSynth 是一款专为上线前评估语音与聊天智能体而设计的 AI 仿真平台。通过在真实的 SIP 电话线路、LiveKit 实时音频流和 HTTP 聊天接口中派遣合成用户,它能在模拟演练中提前发现行为边界问题、网络与处理延迟缺陷以及轮次交替(turn-taking)失败等故障。
该系统能够生成包含多元口音、对话打断、背景杂音以及提示词注入攻击的多轮测试场景。每次交互会话都会被完整记录为端到端调用链路追踪,并依据专门的语音评测指标进行打分;同时,工具虚拟化与沙箱机制确保了合成测试不会向实际生产系统提交未经授权的写操作。
有官方来源支持的使用场景
在真实 SIP 通话中模拟高频打断场景,以全面评估智能体在现实音频条件下的插话(barge-in)响应能力与网络延迟表现。
通过聊天端点发送经过精心设计的提示词注入攻击,用于严格验证智能体的安全护栏、系统提示词保密性以及合规拒绝机制。
在组合场景矩阵下将并发呼叫规模扩展至最高 2,000 条线路,以精准测量智能体底层系统架构的稳定性和承载能力。
官网提供的使用流程
配置呼叫者的性格特征、背景信息、语言偏好、情绪状态以及打断谈话的倾向等具体属性。
基于智能体的业务上下文、产品需求文档(PRD)和提示词配置,自动生成或手动编写各类交互场景与边界案例。
选择语音交互与对话质量专用的评估指标,用于在整个多轮合成会话过程中进行全程监控与打分。
捕获完整的通话调用链路追踪记录,分析仿真演练过程中暴露出的各项故障信号并准确定位根本原因。
针对未通过的测试场景进行端到端重测,在正式部署至生产环境前充分验证并确认行为缺陷已被成功修复。
NovaSynth 摒弃了基于虚拟文本脚本的评测方式,而是通过真实通信信道直连语音智能体。通话通过 Twilio、Plivo 或 Vobiz 等供应商的 SIP 线路路由,并辅以由 LiveKit 和 Pipecat 驱动的实时音频流。这一架构迫使合成交互必须经历现实世界中的网络延迟、背景噪音干扰以及音频异常状况,从而提供高保真的测试结果。
底层任务编排架构利用 BullMQ、PostgreSQL 和 Redis 在分布式队列中高效并行调度测试任务。仿真测试运行期间的工具调用采用了虚拟化技术,可回放只读操作并对写入操作进行沙箱隔离,从而有效防止合成测试对实际生产系统与业务数据产生非预期影响。
用自己的素材和工作流完成验证
核对了哪些信息以及核对时间
基于已核对产品资料的回答
NovaSynth 能够通过 Twilio、Plivo 或 Vobiz 模拟真实的 SIP 电话呼叫,通过 LiveKit 和 Pipecat 模拟实时音频流,并通过标准 HTTP 接口模拟文本聊天交互。
该平台采用了工具虚拟化机制,对读取操作进行回放重放,对写入操作进行沙箱隔离处理,从而确保所有合成测试流程都不会对实际生产系统和真实数据造成篡改或影响。
NovaSynth 支持高达 2,000 条并发线路的通话负载测试;但由于需要提前筹备与配置通信线路资源,企业团队必须在测试前预先向 Noveum 提出申请并协调调度。
平台会将每次合成会话完整记录为调用链路追踪,并利用超过 30 项针对语音 AI 专属定制的评测指标进行打分,同时涵盖平台更广泛的 100 多项评测器套件。
Noveum 产品支持作为标准 SaaS 云服务使用,也支持部署在客户自有的 VPC 环境内(并支持自带 ClickHouse 数据库),同时还提供完全离线的本地私有化部署方案。