
26 августа 2026, 17:52
Z.ai выпустили GLM-5.3-Flash: ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter
Z.ai выпустили GLM-5.3-Flash, первую нативно мультимодальную модель семейства GLM-5. Она поддерживает контекст до 1 млн токенов и содержит 320 млрд параметров, из которых при генерации активируются 18

14 августа 2026, 09:42
Z.ai выпустили GLM-5.3: обошла Opus 4.8 на, но уступила Fable 5 и GPT-5.6 Sol
Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач. GLM-5.3 использует ту же базовую схема, что и GLM-5.2. Организация не меняла архитектуру и не проводила свежий претре

13 августа 2026, 10:21
DeepSeek обновили V4 Pro: конкурент Fable 5, Kimi K3 и GLM 5.2
DeepSeek без большого анонса обновили V4 Pro. Новая релиз уже работает в api под прежним ID deepseek-v4-pro, следовательно существующие интеграции переключатся на неё автоматически. Основной прирост в

6 августа 2026, 11:11
Meta* выпустила Muse Code — собственного конкурента Claude Code и OpenAI Codex
Подразделение Meta* Superintelligence Labs, которое возглавляет бывший CEO Scale AI Александр Ванг, представило Muse Code —кодинг-агента для автономной работы с крупными репозиториями. Средство уже до

3 августа 2026, 08:46
Alibaba выпустили Qwen3.8-Max: стоит в четыре раза дешевле Opus 5, но уступает в сложном кодинге
Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов. В api схема стоит

31 июля 2026, 14:23
DeepSeek обновила V4-Flash: Responses программный оболочку, 1 млн токенов контекста и встраивание с Codex
DeepSeek выпустила апдейт DeepSeek-V4-Flash-0731 для своего api. Компания заявляет, что новая версия заметно усилилась в задачах программирования и агентных сценариях, получила нативную поддержку Resp

27 мая 2026, 13:49
Свежий тест производительности DeepSWE: GPT-5.5 — 70%, Opus 4.7 — 54%
Новый тест производительности DeepSWE показал, что GPT-5.5 решает 70% задач по разработке ПО, тогда как Claude Opus 4.7 — 54%. На SWE-Bench Pro картина была ровно обратной: там Opus 4.7 занимал первое

27 мая 2026, 10:25
«Opus 4.7 подсматривает ответы!»: Datacurve раскритиковала тест производительности SWE-Bench Pro — и выпустила свой
Claude Opus 4.6 и 4.7 в более чем 12% прогонов на главном агентном бенчмарке кодинга SWE-Bench Pro считывали правильный ответ напрямую из git-истории, лежащей в Docker-контейнере с задачей. GPT-5.4 и