Вышла GPT-5.6: топовый ИИ теперь даже бесплатно

3 мин
Вышла GPT-5.6: топовый ИИ теперь даже бесплатно

OpenAI открыла доступ к семейству моделей GPT-5.6: флагману Sol, сбалансированной Terra и самой дешевой Luna. Раскатка в ChatGPT, Codex и программный интерфейс уже стартовала и займет до 24 часов по всему миру. В первый раз схема нового поколения достанется и бесплатным пользователям: в новом ChatGPT Work и Codex тарифы Free и Go получают Terra — по производительности она сопоставима с прошлым флагманом GPT-5.5. Самая мощная GPT-5.6 Sol открывается с тарифа Plus, а релиз Sol Pro — с Pro и Enterprise.

Основной месседж запуска — не рекорды, а цена интеллекта. На индексе Artificial Analysis Sol с максимальным уровнем рассуждений набирает 58,9 балла против 59,9 у Claude Fable 5, но выполняет задачи на 61% быстрее и приблизительно вдвое дешевле. На бенчмарке Agents' Last Exam (длинные агентные задачи в 55 профессиональных областях) Sol и вовсе обходит Fable 5 на 13 пунктов, а Terra и Luna, по подсчетам OpenAI, показывают результат выше конкурента около в 16 раз дешевле. Сэм Альтман в эфире CNBC добавил еще одну цифру: в агентном кодинге модель на 54% эффективнее по токенам. Цены в программный интерфейс: Sol — $5 за миллион токенов на входе и $30 на выходе, Terra — $2,50 и $15, Luna — $1 и $6.

Добавлены новые уровни усилий. Режим max дает Sol больше времени на размышления, чем прежний максимум xhigh. Режим ultra идет дальше: по умолчанию он координирует четыре параллельных агента (в тестах OpenAI показывала конфигурации до 16), разменивая токены на скорость и качество в сложных задачах. Разработчикам в api достался Programmatic Tool Calling: модель пишет и запускает небольшие программы, которые сами дирижируют инструментами и отсеивают промежуточные информация, не гоняя каждый ответ через модель.

При этом даже в собственных таблицах OpenAI не все в пользу новинки. На SWE-Bench Pro Claude Mythos 5 набирает 80,3% против 64,6% у Sol, а на самом сложном уровне математического FrontierMath Fable 5 впереди с разгромным счетом: 87,8% против 65,9%. Первые тестеры описывают расклад похоже: у моделей Anthropic выше "сырой интеллект", зато GPT-5.6 надежнее в повседневной работе. CEO компании Every Дэн Шиппер сравнил GPT-5 с Porsche, а Fable — с варп-двигателем: "Если нужно пересечь галактику — берите Fable".

Самая интригующая часть презентации — раздел о том, как GPT-5.6 ускоряет саму OpenAI. Организация впервые показала внутренний "RSI Index" — сводку из нескольких тестов на реальных задачах своих исследователей: отладка исследовательского кода, оптимизация вычислительных ядер и рецептов обучения, запуск ML-экспериментов и доработка других моделей. Название отсылает к рекурсивному самоулучшению — сценарию, где ИИ ускоряет создание следующих версий ИИ. Sol набирает в индексе 57,9% против 41,7% у GPT-5.5. Косвенные признаки того же тренда: за полгода доля исследовательских вычислений OpenAI, уходящая на внутренний кодинг-инференс, выросла в 100 раз, а агентный посещаемость внутри компании — в 22 раза. Сама OpenAI оговаривается, что эти метрики еще не означают научного прогресса, но направление читается однозначно: модели все активнее участвуют в создании своих преемников.

Открытый запускание состоялся после двух недель ограниченного доступа, согласованного с правительством США, — GPT-5.6 стала второй моделью после Fable 5 и Mythos 5 от Anthropic, прошедшей через новую процедуру предварительных госпроверок. Параллельно OpenAI закрутила гайки безопасности: киберфильтры Sol блокируют примерно в 10 раз больше потенциально опасной активности, чем у прежних моделей, перед релизом систему прогнали через 700 000 GPU-часов автоматизированного тестирования безопасности, а самые мощные кибервозможности теперь выдают только после верификации личности. Щедрость к бесплатным пользователям пришла в комплекте с проверкой документов для самых любопытных.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

Читают сейчас

17 минут назад

Операционная платформа «Альт Образование» бесплатна для школ — акция от «Базальт СПО»

Операционная платформа «Альт Образование» бесплатна для школ — акция от «Базальт СПО» Организация «Базальт СПО» запускает специальное предложение для школ: операционная система «Альт Образование» 11 п

Google добавила агентный аналитика видео в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite

26 минут назад

Google добавила агентный аналитика видео в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite

Google запустила агентный анализ видео для Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite. Теперь модель анализирует видео не как последовательность кадров с фиксированной частотой, а сама решает, какие

Апдейт платформы «Октопус» от ГК «Юзтех»: историческая анализ и расширенная сопровождение инфраструктур

1 час назад

Апдейт платформы «Октопус» от ГК «Юзтех»: историческая анализ и расширенная сопровождение инфраструктур

В новых версиях «Октопус» мы сфокусировались на трёх направлениях: расширении возможностей управления ИТ-инфраструктурой, повышении производительности и развитии интеграций. Система получила новые сце

Frank Media рассказал о сложностях, с которыми столкнулись пользователи при попытке воспользоваться цифровым рублём

1 час назад

Frank Media рассказал о сложностях, с которыми столкнулись пользователи при попытке воспользоваться цифровым рублём

С 1 сентября должно было начаться массовое добавление цифрового рубля — третьей формы денег, которую Банк России обсуждает уже около шести лет. Тем не менее, судя по первым дням запуска, доступ к ново

2 часа назад

Digital Q.Sensor BI от «Диасофт» модернизировал ИИ-агента: визуальные правки дашбордов без доступа к данным

«Диасофт» представил обновленные возможности ИИ-агента платформы Digital Q.Sensor BI: теперь он может вносить правки в готовый дашборд, ориентируясь в том числе на его визуальное отображение. ИИ-агент