26 февраля 2026, 17:59
Inception Labs представляет диффузионную языковую модель Mercury 2

Американский стартап-компания Inception представил Mercury 2 — первую языковую модель, использующую диффузионную архитектуру вместо традиционной авторегрессии, что даёт возможность ей генерировать текст в пять раз быстрее существующих аналогов.
Вместо последовательного предсказания токенов схема создает черновой ответ полностью и итеративно его улучшает — аналогичным способом работают генераторы видео и картинок. В результате Mercury 2 достигает скорости более чем 1000 токенов в секунду, при этом качество сопоставимо с Claude 4.5 Haiku и GPT-5.2 Mini.
Сегодня почти все языковые модели, включая решения от OpenAI, Anthropic и Google DeepMind, работают на основе авторегрессивной архитектуры — они генерируют текст последовательно, токен за токеном. Такой решение ограничивает скорость: чем глубже рассуждение, тем выше задержка и затраты.
В ответ на это индустрия инвестировала миллиарды долларов в чипы-ускорители, оптимизацию инфраструктуры и сжатие моделей, тем не менее сам принцип последовательной генерации оставался неизменным.
Mercury 2 предлагает альтернативу — архитектуру, основанную на диффузии. Вместо пошагового предсказания следующего токена схема формирует черновой вариант ответа целиком, а затем итеративно уточняет его, обрабатывая много токенов параллельно. Такой решение, ранее применявшийся преимущественно в генерации изображений и видео, даёт возможность радикально повысить пропускную способность без необходимости полагаться исключительно на аппаратную оптимизацию.
По данным компании, Mercury 2 достигает скорости свыше 1000 токенов в секунду на графических процессорах NVIDIA Blackwell и одновременно показывает качество, сопоставимое с Claude 4.5 Haiku и GPT-5.2 Mini. Модель поддерживает контекстное окно объёмом до 128 000 токенов.
В стандартных бенчмарках она получила 91,1 балла на AIME 2025 и конкурентные результаты в задачах по программированию, научных вычислениях и логическом анализе. Стоимость вывода заявлена на уровне $0,25 за миллион входных токенов и $0,75 за миллион выходных.
Ключевое преимущество подхода — не только скорость, но и устойчивость вывода. Благодаря итеративному уточнению модель способна корректировать ошибки в процессе генерации, формировать структурированные ответы в формате JSON и более предсказуемо работать в агентных системах. Это особенно важно для многошаговых рабочих процессов, где задержка на каждом этапе накапливается и влияет на итоговый пользовательский опыт.
В компании подчеркивают, что Mercury 2 уже ориентирована на промышленное применение: от интерактивного программирования и голосовых интерфейсов до RAG-конвейеров и корпоративной автоматизации.
МСхема совместима с программный оболочка OpenAI, что даёт возможность интегрировать её в существующие стеки без серьезной переработки инфраструктуры. Среди первых партнеров и инвесторов проекта — Menlo Ventures, Mayfield, M12 и ряд технологических фондов, а поддержку в инфраструктуре обеспечивает NVIDIA.
Mercury 2 уже доступна через программный интерфейс компании, и Inception активно привлекает партнеров для масштабного внедрения. Если заявленные показатели подтвердятся на практике, диффузионная архитектура может стать новым этапом эволюции языковых моделей — не за счет наращивания вычислительной мощности, а благодаря смене самого принципа генерации.
Читают сейчас

1 час назад
Вышел альфа-релиз Paint.NET 5.2 с экспериментальной поддержкой Wine/Linux
1 сентября 2026 года состоялся выпуск альфа-версии графического редактора с открытым исходным кодом Paint.NET 5.2 для Windows 10/11 (64-бита) и с экспериментальной поддержкой Wine/Linux (Wine 11.14, U
1 час назад
Операционная платформа «Альт Образование» бесплатна для школ — акция от «Базальт СПО»
Операционная платформа «Альт Образование» бесплатна для школ — акция от «Базальт СПО» Организация «Базальт СПО» запускает специальное предложение для школ: операционная система «Альт Образование» 11 п

1 час назад
Google добавила агентный аналитика видео в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite
Google запустила агентный анализ видео для Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite. Теперь модель анализирует видео не как последовательность кадров с фиксированной частотой, а сама решает, какие

2 часа назад
Апдейт платформы «Октопус» от ГК «Юзтех»: историческая анализ и расширенная сопровождение инфраструктур
В новых версиях «Октопус» мы сфокусировались на трёх направлениях: расширении возможностей управления ИТ-инфраструктурой, повышении производительности и развитии интеграций. Система получила новые сце

2 часа назад
Frank Media рассказал о сложностях, с которыми столкнулись пользователи при попытке воспользоваться цифровым рублём
С 1 сентября должно было начаться массовое добавление цифрового рубля — третьей формы денег, которую Банк России обсуждает уже около шести лет. Тем не менее, судя по первым дням запуска, доступ к ново