让你的组织拥有数字员工,再让数字员工成为智能体组织!拨打 021-3106-8238 体验!

立即注册

Voice Agent

电话咨询

预约演示

扫码获取

  • 在线咨询

  • 立即注册

  • 案例试听

大家都在搜的「 VoiceAgent 3.0」到底是什么?
云蝠动态 云蝠智能 大模型技术 AI语音智能体 企业数字化转型VoiceAgent 3.0 企业级语音解决方案 智能外呼机器人 业务流程优化 客户沟通效率 南京栖霞创业
2026-08-14 14:06:31

最近,南京栖霞发布发布了一段对云蝠智能创始人魏佳星的采访视频。

视频里,一个细节引起了不少人的注意:

2018 年,魏佳星在栖霞埋下创业的种子。八年后,VoiceAgent 3.0 正式走向市场。

视频发布后,不少网友开始在评论区讨论,也有人直接搜索:

“VoiceAgent 3.0 是什么?”

如果把这个问题说得简单一点,VoiceAgent 3.0 并不是传统意义上“按流程念话术”的智能外呼机器人,而是一套面向企业真实业务场景打造的企业级语音智能体

它正在尝试解决一个更实际的问题:

让 AI 不只是“能打电话”,而是真正能够听懂客户、完成沟通,并参与企业业务流程。

VoiceAgent 3.0,首先改变的是“打电话”这件事

过去很多人对 AI 电话的印象,可能还是:

说话生硬、反应慢、客户一打断就不知道怎么回答,一旦问题超出预设流程,只能不断重复固定话术。

而大模型带来的变化,是让电话另一端的 AI 开始具备更强的理解、判断和应变能力

VoiceAgent 3.0 将大模型能力真正放进企业通话场景中。

客户说得快一点、慢一点,临时换一个问题,甚至话说到一半停顿、犹豫,系统都需要判断:

客户说完了吗?真正想问什么?下一句话应该怎么回应?

所以 VoiceAgent 3.0 的升级重点,并不是简单增加几个功能按钮,而是在围绕一件事情持续优化:

图片

让 AI 更接近一次真实、自然、有效的业务沟通。

不只是“会说”,还要“听得懂”

一次真正的电话沟通,从来不是单向输出。

在 VoiceAgent 3.0 中,语音识别、上下文理解、轮次判断和环境感知能力被进一步强化。

例如客户说:

“我前几天咨询过那个课程,就是暑假的那个……”

对于传统系统来说,“那个课程”很可能无法匹配到标准关键词。

但语音智能体需要结合前面的对话内容,理解客户究竟在说什么,再继续完成沟通。

类似的情况每天都发生在企业业务里:

客户插话、表达不完整、带有口语、省略上下文,甚至周围还有环境噪声。

AI真正进入企业电话场景,就必须面对这些“不标准”。

这也是 VoiceAgent 3.0 与传统流程式电话机器人的重要区别。

从“一个模型”,变成企业可调用的一组 AI 能力

VoiceAgent 3.0 背后也不再依赖单一模型。

企业可以根据不同场景调用不同的大模型能力,让模型负责理解、推理和生成,再通过语音能力将结果实时表达出来。

与此同时,企业还可以使用声音克隆、个人音色、多参数语音调节等能力,让不同业务拥有更加符合自身品牌和客户群体的声音。

换句话说,未来企业配置一个语音智能体,越来越像是在配置一名数字员工:

它应该说什么、知道什么、拥有什么技能、能够调用哪些系统,都可以围绕实际业务进行设置。


VoiceAgent 3.0 更关键的变化,是开始“做事情”


真正决定 VoiceAgent 能不能进入企业核心业务的,其实不是它说话有多像真人。

而是:

打完这一通电话以后,它能不能继续把事情做完?

这也是 VoiceAgent 3.0 重点发展的方向。

通过 Skills、插件、MCP、Webhook 等能力,语音智能体可以与企业已有系统连接起来。

例如一次客户咨询结束后,可以继续:

识别客户意向 → 查询业务信息 → 记录通话结果 → 写入 CRM → 创建客户跟进 → 触发后续任务

电话不再是一个孤立的沟通入口,而开始成为企业数字化业务流程中的一个节点。

这一步很重要。

因为企业真正需要的,从来不是一个“会聊天的 AI”,而是一个能够完成任务的 AI



VoiceAgent 正在进入更多真实业务

当语音智能体具备理解、沟通和执行能力之后,它的应用范围也开始发生变化。

它可以出现在:

教育机构的招生咨询与课程回访

电商平台的订单催付与售后回访

物业公司的通知、报修与满意度调查

酒店、餐饮和文旅行业的预订咨询

金融保险行业的客户服务与信息确认

企业销售团队的线索筛选与客户跟进

客服中心的大规模呼入接待……

这些行业看起来完全不同,却有一个共同特点:

存在大量需要通过“说话”完成的重复沟通。

过去,这些工作高度依赖人工坐席。

现在,大模型开始让其中一部分工作可以交给语音智能体完成。

为什么是现在?

过去几年,大模型最大的变化之一,就是 AI 从“能够生成内容”,开始进入真实业务流程。

文字智能体可以处理知识问答、文档和数据。

而语音智能体面对的是一个更复杂的世界:

它必须实时听见、实时理解、实时判断,再实时回答。

任何一个环节出现延迟或者理解偏差,客户都能立即感受到。

因此,VoiceAgent 本质上是大模型技术真正走进现实世界的一种形式。

AI 不再只存在于聊天框里。

它开始拿起电话,进入企业客服、销售、运营和服务体系。

从栖霞出发,八年之后

2018 年,云蝠智能从南京栖霞开始创业。

八年时间里,企业通信从传统呼叫中心、智能外呼,一路走到了今天的大模型 VoiceAgent。

技术名称一直在变化,但云蝠持续解决的其实还是同一个问题:

企业怎样更高效地与客户沟通。

今天,当越来越多人开始搜索“VoiceAgent 3.0 是什么”,这个问题背后真正值得关注的,也许并不仅仅是一个产品版本。

它代表的是一种正在发生的变化:

过去,AI帮助人处理信息。

现在,AI开始直接参与人与人之间的沟通,并进一步参与业务执行。

而这,或许才是 VoiceAgent 3.0 真正值得关注的地方。

— END —

云蝠智能 是一款 AI 原生的大模型语音智能体,我们为企业提供AICC大模型呼叫中心,在ChatBOT和CRM基础上提供包括语音智能体,产品能力包括了大模型语音外呼、智能呼入、网页实时语音交互 sdk 及 api。

我们由来自阿里巴巴等公司优秀的开发者组成,曾经获得华为云开发者大赛、讯飞开发者大赛冠军等诸多荣誉。获得奇绩创坛(陆奇博士)、AMINO丰元资本、御势资本、金沙江创投数千万投资。拥有省级民营科技企业、全国呼叫中心及信息发送资质,拥有软件著作权27项及商标4项。

在呼入工单建立、投诉处理及需求跟进等场景完全取代人工客服,在会员回访、客户召回场景取代大多数客服。当前我们的月均AI人机通话量为 6000 万通电话,服务于 4.5 万家终端企业。

点阅读原文,预约行业专属解决方案!


Loading...