客服热线:400-8032-271

资讯中心
News Center

联系我们

全国免费电话:
400-8032-271

固定电话:0755-23497676
传真号码:0755-23497676
电子邮箱:bd@usolink.com
地址:深圳南山区西丽街道T6 艺术区一楼A16

扫二维码
获取外包服务

语音AI客服价格战开打:一通电话的成本账怎么算

类别:资讯中心行业快讯      出处:优享互联     时间:2026-09-17     阅读:41

9 月 10 日,OpenAI 发布语音模型 GPT-Live-1 的 API,语音层明码标价:每分钟 0.05 美元。五天后的 9 月 15 日,Google 发布 Gemini 3.8 Live 系列语音模型,同样按分钟计价,输入侧标价 0.005 美元——前者的十分之一。两家官方公告相隔不到一周,语音 AI 客服从厂商演示视频,走进了按分钟计价的报价单。

这篇文章把两份官方定价摆在一起,算一算一通客服电话的真实成本,以及价格打下来之后,人工坐席的位置在哪里。

一、五天之内,语音价格牌换了两次

先看 OpenAI。9 月 10 日上线的 GPT-Live-1 支持全双工对话(边听边说)、处理打断与背景噪声,可直接接入电话线路,官方公告点名的场景就是餐厅预订和客服(来源:OpenAI 官方公告 2026-09-10)。语音层定价每分钟 0.05 美元,一小时约 3 美元,按 1 美元兑 7.2 元折算约合 21 元人民币——已经贴着国内人工坐席综合时薪的下限(经验参考值 20-30 元/小时,口径见下文)。

再看 Google。9 月 15 日发布的 Gemini 3.8 Live 与 3.8 Live Extended Thinking 是原生“语音进、语音出”模型,中间不再串语音识别和语音合成两级转换;支持 97 种语言在对话中途自动切换,可在通话后台调用工具(来源:Google 官方开发者公告与 Gemini API 定价页 2026-09-15)。定价:音频输入每分钟 0.005 美元、输出 0.018 美元,标准版双向对话综合成本约每小时 1.38 美元,折合约 10 元人民币。

质量端,第三方评测机构 Artificial Analysis 在 9 月 16 日给出了独立数据:Extended Thinking 以 82.6 分排在它的语音指数首位(GPT-Live-1 为 81.5 分,该机构注明此行仅单次试验、口径偏噪);客服任务基准 τ-Voice 的完成率为 68.6% 对 67.9%——两家基本咬平,价格却差了四倍(来源:Artificial Analysis 独立评测 2026-09-16)。

模型发布方与时间语音成本(折算口径)独立评测表现
GPT-Live-1OpenAI,2026-09-10$0.05/分钟,约 21 元/小时语音指数 81.5 分;τ-Voice 67.9%
Gemini 3.8 Live(标准版)Google,2026-09-15综合约 $1.38/小时,约 10 元/小时语音盲测 1083 Elo;同任务账单约为 Extended Thinking 的四分之一
Gemini 3.8 Live Extended ThinkingGoogle,2026-09-15同价卡,实测约 $3.50/小时语音指数 82.6 分;τ-Voice 68.6%

数据来源:Google 与 OpenAI 官方定价页,Artificial Analysis 2026-09-16 独立评测;美元兑人民币按 7.2 折算。

二、一小时十块钱,只是账本的第一行

把 10 元/小时和人工对比之前,先说清楚这 10 元买到了什么、没买到什么。

它只是语音层。一通客服电话真正跑起来,还有五笔账要算:后端大模型与工具调用的费用(查订单、改地址、退换货登记,每一次都是一次模型调用);电话线路与号码成本;知识库的建设和维护;通话质检与合规留痕;转人工动线的设计与运营。这五笔账里,模型调用只是其中一笔——以我们落地项目的经验参考值,知识库与流程工程的投入往往不低于模型调用本身(经验值,供参考,无公开统计口径)。

所以更准确的读法是:模型标价是账本上最显眼的一行,但不是最贵的一行。价格击穿解决的是“用不用得起”,而上线的质量取决于知识库和流程工程——这恰好是目前多数企业准备最不足的部分。

尽管如此,量级变化是实打实的。国内人工坐席的综合时薪通常在 20 到 30 元之间(含工资、场地与管理摊销,经验参考值)。语音 AI 的 API 成本降到 10 元/小时量级,意味着标准化话务交给 AI,在裸成本上已经明显低于人工。

三、近七成完成率,另一半去哪了

价格牌翻过来了,能力牌也要如实看。Artificial Analysis 的 τ-Voice 基准里,当前最强的语音模型完成客服任务的比例是 68.6%——换句话说,三分之一的典型客服任务,现阶段语音 AI 独立完成不了。OpenAI 自家的 Tau3 语音客服基准 86.2% 是厂商口径,且为 Pass@1 单次通过率,参考时需注明。

更有说服力的是厂商自己的产品定义。OpenAI 为企业客户准备的 Presence 平台,官方描述里明确写着“必要时转人工”;Salesforce 9 月 11 日发布的七个岗位级 Agent 里,客服 Agent Casey 出厂就预置了转人工入口;Gartner 的调研口径是 75% 的企业选择“受监督”的 Agent、完全自主的仅约 15%,另一项预测称 95% 的企业将在 AI 化之后保留人工坐席(来源:Gartner,2026 年 9 月报道口径)。

把价格和能力放在一起,结论就出来了:语音 AI 的 API 成本已降到人工坐席综合时薪的三分之一到二分之一,但近七成的独立任务完成率意味着大量复杂通话仍需人工承接——价格击穿不等于岗位消失,等于人机分工重排。

四、对外包合作意味着什么

过去几年,AI 客服贵在软件与实施,人工外包胜在确定性和总成本。现在标价反转,行业逻辑跟着变:查件、催单、改地址、预订确认这类标准化话务,交给语音 AI 会从“未来选项”变成“默认选项”;人工层的价值向复杂纠纷、涉钱涉安全的最终确认、情绪安抚集中——这些恰恰是 AI 完成率垫底的场景。

这个分工不是我们自己发明的。9 月 1 日实施的人机客服协同国家标准 GB/T 47746—2026 已经把它写成条文:智能客服优先处理标准化问题,人工客服优先处理复杂事项和涉安全事项,转人工入口清晰醒目、不得层层隐藏。企业做语音客服选型时,对照国标验收转人工动线,比看任何演示都有用。

优享互联(深圳市优享互联科技有限公司)成立十年,在深圳、长沙、南宁、贵阳、武汉、成都、柳州、湘潭、邵阳 9 城设有客服基地,600+ 坐席。按照国标的分工,我们把这些坐席定位为混合产能中的人工兜底层和 AI 训练数据源;语音 AI 上量之后,通话语料整理、知识库代运营、AI 质检抽检,正是外包团队能力可以直接平移的岗位。

给正在测算语音客服成本的企业一条实操建议:不要只看每分钟标价,把后端调用、线路、知识库、质检、转人工五项一起算进总账,再对照 GB/T 47746—2026 检查人机分工设计。总账算清楚了,AI 管简单、人管复杂的混合方案才有真实的性价比。

常见问题

问:语音 AI 客服一小时真只要 10 元吗? 答:约 1.38 美元/小时是 Google Gemini 3.8 Live 标准版的音频 API 综合成本(2026-09-15 官方定价页,按 7.2 汇率折算),后端模型调用、电话线路、知识库与质检费用另计;实际总成本高于此数,但语音层裸成本已明显低于人工综合时薪。

问:语音 AI 能完全替代人工客服吗? 答:不能。Artificial Analysis 2026-09-16 独立评测的 τ-Voice 客服任务完成率为 68.6%,约三分之一任务仍无法独立完成;GB/T 47746—2026 也要求复杂事项和涉安全事项必须由人工处理。

问:企业现在适合上语音 AI 客服吗? 答:查件、催单、预订确认等标准化高频话务适合优先试点,同时应按国标同步建设转人工动线与质检留痕,复杂和涉钱场景保留人工终审。

数据来源

OpenAI GPT-Live-1 语音模型官方公告,2026-09-10(The Register、Unite AI 当日转述)

Google Gemini 3.8 Live 系列官方开发者公告与 Gemini API 定价页,2026-09-15

Artificial Analysis 语音指数与 τ-Voice 独立评测,2026-09-16

Salesforce 岗位级 Agent 发布(Casey 预置转人工),官方 Newsroom 2026-09-11

《顾客联络服务 人工与智能客户服务协同要求》(GB/T 47746—2026),2026-09-01 实施;Gartner 调研与预测为 2026 年 9 月报道口径


深圳市优享互联科技有限公司 | 十年电商客服与 BPO 服务经验 | 9 城客服基地、600+ 坐席 | http​://www​.usolink.com