12 мая 2026, 16:47
Thinking Machines создаёт слушающий и говорящий ИИ
ИИ-стартап Thinking Machines Lab, основанный бывшим техническим директором OpenAI Мирой Мурати, объявил о версия моделей взаимодействия. Они будут способны как слушать, так и говорить.
Все современные модели работают по одинаковому принципу: они выслушивают запрос, а потом отвечают. Thinking Machines пытается изменить это, создав схема, которая обрабатывает пользовательский ввод и одновременно генерирует ответ, так что это больше напоминает диалог.
Включение интерактивности в схема открывает множество возможностей, как обещает компания, включая:
бесперебойного управления диалогом. Схема неявно отслеживает, думает ли говорящий, уступает ли он, корректирует ли свою речь или приглашает к ответу;
вербальных и визуальных вставок. Модель вмешивается по мере необходимости в зависимости от контекста, а не только когда потребитель заканчивает говорить;
одновременной речи. Потребитель и схема могут говорить одновременно (например, перевод в реальном времени);
осведомлённости о времени. Схема напрямую ощущает прошедшее время;
одновременного вызова инструментов, поиска и генерации пользовательского интерфейса. Во время разговора и прослушивания пользователя схема может одновременно искать информацию, просматривать веб-страницы или генерировать пользовательский интерфейс, вплетая результаты в разговор по мере необходимости.
Организация называет подход «полнодуплексным», и компания утверждает, что её модель TML-Interaction-Small отвечает за 0,40 секунды, что примерно соответствует скорости естественного человеческого разговора и значительно быстрее, чем скорость ответа сопоставимых моделей от OpenAI и Google.
Пока это предварительная версия для исследований, а не готовый продукт, и компания не собирается выпускать её в публичный доступ. «Ограниченная предварительная версия для исследований» появится в ближайшие некоторое количество месяцев, а более широкий выпуск запланирован на конец этого года.
Для измерения качества взаимодействия модели исследователи использовали FD-bench, один из немногих существующих бенчмарков, предназначенных для измерения интерактивности. В FD-bench версии 1.5 модели предоставляется предварительно записанный аудиоматериал, и она должна реагировать в определённые моменты времени. Этот тест производительности измеряет поведение модели в нескольких сценариях: прерывание со стороны пользователя, обратный канал связи с пользователем, разговор с другими и фоновая речь. Отмечается, что TML-Interaction-Small показала хорошие результаты во всех этих областях. Для количественной оценки ИИ они применили Audio MultiChallenge, распространённый проверка, отслеживающий способность следовать инструкциям.
Осенью 2025 года Thinking Machines Lab показал свой первый продукт — средство Tinker, который автоматизирует разработка пользовательских передовых моделей искусственного интеллекта. Он позволяет тонко настраивать ряд больших и малых моделей с открытыми весами, в том числе такие как Qwen-235B-A22B.
Читают сейчас

31 минуту назад
Астрономы обнаружили маленькие красные точки, готовящиеся к слиянию
Существует мнение, что в крупных галактиках современной Вселенной находятся сверхмассивные чёрные дыры (СМЧД). Тем не менее точно неизвестно, как именно эти чёрные дыры стали столь массивными, хотя ас

2 часа назад
Вышел альфа-релиз Paint.NET 5.2 с экспериментальной поддержкой Wine/Linux
1 сентября 2026 года состоялся выпуск альфа-версии графического редактора с открытым исходным кодом Paint.NET 5.2 для Windows 10/11 (64-бита) и с экспериментальной поддержкой Wine/Linux (Wine 11.14, U
2 часа назад
Операционная платформа «Альт Образование» бесплатна для школ — акция от «Базальт СПО»
Операционная платформа «Альт Образование» бесплатна для школ — акция от «Базальт СПО» Организация «Базальт СПО» запускает специальное предложение для школ: операционная система «Альт Образование» 11 п

2 часа назад
Google добавила агентный аналитика видео в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite
Google запустила агентный анализ видео для Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite. Теперь модель анализирует видео не как последовательность кадров с фиксированной частотой, а сама решает, какие

3 часа назад
Апдейт платформы «Октопус» от ГК «Юзтех»: историческая анализ и расширенная сопровождение инфраструктур
В новых версиях «Октопус» мы сфокусировались на трёх направлениях: расширении возможностей управления ИТ-инфраструктурой, повышении производительности и развитии интеграций. Система получила новые сце