当你在客服电话里听到的那个声音越来越像真人,它是否应该主动承认自己是机器?ElevenLabs CEO给出的答案是:现阶段应该。

发生了什么

TechCrunch记者与ElevenLabs CEO进行了一次约20分钟的对话,核心话题之一就是AI语音的身份披露问题。据TechCrunch报道,ElevenLabs目前估值达到220亿美元。这家公司的语音技术被大量用于客服电话的另一端——也就是说,很多人已经在不知情的情况下和它说过话。

CEO的表态可以概括为:企业应该告诉用户,接电话的是AI,至少在“接到机器”成为所有人的默认预期之前应当如此。他没有主张永久性的强制披露,而是把它定位成一个过渡期的做法。

为什么重要

这件事的分量不在技术,而在信任结构。

语音合成过去几年的进步,主要发生在“像不像人”这个维度上:语调、停顿、呼吸感、情绪起伏。当这些指标逼近真人,判断对方是不是机器就从一个技术问题变成了一个社会问题。用户无法靠听觉分辨,只能依赖对方主动说明。

ElevenLabs处在一条特殊的位置上:它既是这项能力的提供方,也是披露责任的间接承担者。它的客户是企业和开发者,真正面对终端用户的是这些客户。所以CEO的表态更像是一种行业倡议,而不是产品规则——它没有强制力,但给出了一个可被引用的立场。

值得注意的是,这个立场本身带有时间限定。“直到大家默认对面可能是机器为止”——这意味着披露义务被定义为一种临时补丁,而非长期规范。这个前提是否成立,取决于公众预期变化的速度,而这一点目前并没有共识。

影响与看点

对企业而言,短期内最现实的问题是合规成本与体验损耗的权衡。在通话开头加一句“本次服务由AI提供”,技术上毫无难度,但会改变用户对整个通话的预期,也可能影响转化和满意度指标。不同行业、不同地区的监管口径并不一致,这会让跨国业务的披露策略变得复杂。

对开发者来说,值得关注的是接口层面会不会出现披露相关的约定。如果平台方开始提供标准化的披露话术或开关,这会比监管文件更快地渗透到实际产品里。

对普通用户,这件事的意义更直接:你听到的声音不再能作为身份凭证。语音曾经承载的“确认对方是谁”的功能正在失效,而替代方案——比如披露、水印、回拨验证——目前都还不成熟。

一个独立的判断是:把披露定义为过渡期措施,逻辑上说得通,但风险在于过渡期没有明确的终点。当“对面可能是机器”成为默认预期,用户实际上失去了分辨的能力,只是不再感到意外而已。这不等于问题被解决。

ElevenLabs的估值说明市场对语音交互的期待很高。但估值衡量的是能力,不衡量信任。这两者之间的落差,才是接下来几年真正需要被填上的部分。