Hugging Face与Cerebras宣布合作,将Google的Gemma 4模型部署到Cerebras的晶圆级芯片上,用于实时语音AI。该集成利用Cerebras的硬件加速,显著降低推理延迟,使语音交互更流畅。此举旨在推动开源模型在语音助手等实时场景中的应用。