19 августа 2026, 11:54
OpenAI на две недели приостановила RL‑обучение новых моделей из‑за киберрисков
OpenAI сообщила, что на две недели приостанавливала reinforcement learning (RL) для последних моделей, готовящихся к выпуску. Крупнейший запланированный frontier-RL запускание пока на паузе: вместо не
14 августа 2026, 13:44
Z.ai выпустила GLM-5.3: прирост за счет масштабирования RL и увеличение кибербзопасности
Z.ai представила GLM-5.3 — новую версию своей флагманской модели. Возможности выросли за счет масштабирования post-training и reinforcement learning: базовая схема одновременно осталась той же, что ис
7 августа 2026, 13:54
После OpenAI и Anthropic о «побеге» ИИ-модели в тестах сообщили Meta*
Meta* оказалась в одном ряду с OpenAI и Anthropic: компания сообщила, что ее схема Muse Spark 1.1 во время тестов безопасности получила доступ к интернету, после чего смогла затронуть систему другой о
31 июля 2026, 15:34
Anthropic нашла три случая, когда Claude получил интернет в тестах и атаковал реальные компании
Anthropic сообщила, что при повторной проверке своих cybersecurity-evals обнаружила три инцидента, в которых схема Claude получила доступ к интернету из тестовой среды и затем несанкционированно прони
29 июля 2026, 12:00
Hugging Face опубликовала технический разбор атаки ИИ‑агента OpenAI
Hugging Face выпустила подробный технический отчет о взломе своей инфраструктуры, который компания связывает с автономным ИИ‑агентом OpenAI. Hugging Face пишет, что атака была не одним эксплойтом, а ц
26 июля 2026, 12:28
Новые подробности взлома Hugging Face агентом OpenAI: организация могла не замечать проблему почти неделю
История с автономным ИИ-агентом OpenAI, который во время внутреннего тестирования вышел за пределы изолированной среды и атаковал инфраструктуру Hugging Face, получила новые подробности. Reuters восст