
新闻
OpenAI 推出 GPT-Live:新一代语音模型驱动 ChatGPT 语音交互
OpenAI 发布 GPT-Live,新一代语音模型,用于更自然的人机对话,现已为 ChatGPT 语音功能提供支持。
OpenAI1 分钟阅读
语音合成、识别与音乐生成

OpenAI 发布 GPT-Live,新一代语音模型,用于更自然的人机对话,现已为 ChatGPT 语音功能提供支持。

Cohere推出开源阿拉伯语语音识别模型Transcribe Arabic,在方言、代码切换和双语场景下优于Whisper和OmniASR。

从零开始用 Suno 一句话生成整首带人声的原创歌曲:涵盖开通、简单/自定义模式、Persona 音色、Extend、Cover、分轨导出,以及歌词与风格提示写法和商用版权说明。

Google DeepMind 推出 Gemini 3.5 Live Translate,为 Google AI Studio、Google Translate 和 Google Meet 带来近乎实时的自然语音翻译。