Стартап Thinking Machines Lab, основанный Мирой Мурати, бывшим техническим директором OpenAI, представил первую демонстрацию своей инновационной модели, которая ведет диалог с пользователем в реальном времени. Эта система слышит, видит и отвечает одновременно, что позволяет сократить задержку до 0,4 секунды, в то время как у конкурентов, таких как GPT-realtime-2.0 и Gemini-3.1-flash-live, показатели составляют 1,18 и 0,57 секунды соответственно.
В своём блоге команда объясняет, что традиционные чатботы неэффективны в живом общении из-за очередности вопросов и ответов. Thinking Machines изменила архитектуру, убрав очередность и применив потоковую обработку данных. Модель разбивает свои задачи на 200-милисекундные фрагменты, что значительно уменьшает задержки.
Основная модель TML-Interaction-Small активно реагирует на команды, в то время как фоновая модель обрабатывает более сложные запросы. В тестах живого взаимодействия модель демонстрирует выдающиеся результаты, опережая конкурентов. Доступ к новой модели ограничен, однако планируется открытие превью для пользователей в ближайшие месяцы.