Новая модель Thinking Machines Lab демонстрирует живое взаимодействие

Стартап Thinking Machines Lab, основанный экс-техническим директором OpenAI Мирой Мурати, представил свою первую демонстрацию новой модели, которая позволяет пользователю общаться в формате живого разговора. В отличие от традиционных систем, модель слышит, видит и отвечает одновременно, сокращая задержку до 0,4 секунды, что значительно быстрее, чем у конкурентов, таких как GPT-realtime-2.0 и Gemini-3.1-flash-live. В блоге команда объясняет, что стандартные чатботы не подходят для живого диалога, так как они работают по очереди и не могут воспринимать текущую ситуацию. Новация заключается в отказе от турн-режима и переходе на потоковую обработку, деля вход и выход на 200-миллисекундные фрагменты, называемые «микро-турнами». Модель состоит из двух частей: первая отвечает в реальном времени, а вторая обрабатывает сложные задачи асинхронно. На бенчмарках TML-Interaction-Small продемонстрировала высокие результаты, значительно обгоняя конкурентов. Доступ к моделям будет открыт для ограниченной группы партнеров, а полноценный релиз ожидается до конца года.