Компания Google представила обновленную модель голосовых агентов под названием Gemini 2.5 Flash Native Audio, которая уверенно обходит OpenAI gpt-realtime в тестах сложных функциональных вызовов. Согласно результатам теста ComplexFuncBench Audio, новая модель продемонстрировала 71,5% успешных выполнений, в то время как gpt-realtime показал 66,5%. Google утверждает, что точность следования инструкциям разработчика возросла с 84% до 90%, а также улучшено удержание контекста в многоходовых диалогах. Модель уже интегрирована в приложения Gemini и Search Live, предоставляя нативное аудио. Доступ к Gemini 2.5 Flash Native Audio получили разработчики через Google AI Studio и Vertex AI. Первые клиенты, такие как United Wholesale Mortgage, отмечают эффективность голосового ассистента Mia, который помог оформить более 14 000 кредитов. В дополнение к этому, Google запустила бета-версию синхронного перевода в Google Translate, поддерживающую более 70 языков.