GPTProto

Improved Gemini audio models for powerful voice experiences

Google DeepMind:Blog(RSS)··Google / Gemini

Google DeepMind 发布更新的 Gemini 2.5 Flash Native Audio 模型,用于实时语音智能体,在 ComplexFuncBench Audio 上取得 71.5%,开发者指令遵循率从 84% 提升到 90%,已在 Google AI Studio、Vertex AI 上线,并开始在 Gemini Live 和 Search Live 推出。