19 августа 2026, 11:54
OpenAI на две недели приостановила RL‑обучение новых моделей из‑за киберрисков
OpenAI сообщила, что на две недели приостанавливала reinforcement learning (RL) для последних моделей, готовящихся к выпуску. Крупнейший запланированный frontier-RL запускание пока на паузе: вместо не
14 августа 2026, 13:44
Z.ai выпустила GLM-5.3: прирост за счет масштабирования RL и увеличение кибербзопасности
Z.ai представила GLM-5.3 — новую версию своей флагманской модели. Возможности выросли за счет масштабирования post-training и reinforcement learning: базовая схема одновременно осталась той же, что ис

14 августа 2026, 09:42
Z.ai выпустили GLM-5.3: обошла Opus 4.8 на, но уступила Fable 5 и GPT-5.6 Sol
Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач. GLM-5.3 использует ту же базовую схема, что и GLM-5.2. Организация не меняла архитектуру и не проводила свежий претре
5 августа 2026, 19:15
Anthropic начнут проектировать чипы для Claude
Anthropic начала формировать собственное направление по проектированию процессоров для Claude. В свежей вакансии Research Engineer, Chip Design RL организация прямо пишет, что ищет инженера, который н

16 мая 2026, 17:56
AIRI предложил способ, который помогает роботам быстрее адаптироваться к новым условиям без дообучения
Ученые института AIRI предложили метод, который помогает ИИ-агентам быстрее адаптироваться к новым условиям работы без дополнительного дообучения. Идея в том, чтобы схема могла сама определить, в како

7 мая 2026, 13:00
Машинное обучение в реальных условиях: проверьте свои силы на Yandex ML Challenge
21 мая пройдёт Yandex ML Challenge — масштабное соревнование для всех, кто интересуется ML и готов помериться силами в решении разных задач: от работы с LLM до Reinforcement Learning. Участников ждёт

6 мая 2026, 14:02
Машинное обучение в реальных условиях: проверьте свои силы на Yandex ML Challenge
21 мая пройдёт Yandex ML Challenge — масштабное соревнование для всех, кто интересуется ML и готов помериться силами в решении разных задач: от работы с LLM до Reinforcement Learning. Участников ждёт

13 марта 2026, 19:43
В МФТИ обучили RL-агента управлять складскими запасами ритейла
Исследователи Института искусственного интеллекта МФТИ разработали систему управления складскими запасами на основе обучения с подкреплением (reinforcement learning). В тестировании на исторических да