
26 августа 2026, 13:57
Как применять LLM в тестировании: разбираем harness, автотесты и LLM-судью
Поговорим об этом на Bugs Busters — бесплатном митапе ЮMoney для QA-специалистов. В программе — три доклада о задачах, с которыми тестировщики уже сталкиваются при работе с LLM: — как устроен LLM-harn

26 августа 2026, 11:46
Qwen4: первая схема Alibaba на архитектуре нового поколения — Qwen3.8-Flash-Next
Alibaba анонсировали Qwen3.8-Flash-Next — первую публичную схема на архитектуре следующего поколения Qwen4. Открытые веса должны появиться 26 августа в 15:00 UTC. Несмотря на Qwen3.8 в названии, коман

26 августа 2026, 11:23
Процессор OpenAI разогнал Kimi K2.5 почти до 700 токенов в секунду
В июне OpenAI и Broadcom представили Jalapeño, первый собственный чип OpenAI для инференса языковых моделей. Тогда компании рассказывали в основном про архитектуру и обещали начать развёртывание до ко

25 августа 2026, 17:04
Как устроен автоматизированный аудит сайтов в ЮScan
Как проверить, чем на самом деле занимается сайт, если у него тысячи страниц, динамический контент, а часть информации спрятана глубоко в каталоге? В новой статье рассказываем о ЮScan — сервисе автома

25 августа 2026, 13:40
️RAG, агенты и production – честно про AI
3 сентября в 18:00 встречаемся на новом AI Meetup 43;Tech. Без магии и абстрактных прогнозов поговорим про кейсы, архитектуру, метрики и опыт работы с AI в production. В программе: ✔️ Как вырастить му

25 августа 2026, 10:01
Галлюцинации недели: Stripe покупает OpenRouter, Omarchy от DHH с агентом внутри и free Ox Alpha
DDR5 скупают все и сразу, цена за год дала иксы, а планка памяти превратилась в покупку, которую надо обсудить с семьёй. По всем рыночным приличиям счёт за api должен был поехать туда же. Но компании,

21 августа 2026, 16:15
Почти 90% биомедицинских статей несут следы языковых моделей
Препринт, выложенный на arXiv 12 августа, оценивает долю текстов с признаками правки или написания через LLM в открытом архиве PubMed Central. Для статей, вышедших в декабре 2025 года, оценка — прибли

21 августа 2026, 12:00
Новинка от Cerebras: платформа CS-4 с тремя чипами WSE-3 Turbo
Архитектура классических ускорителей для обучения и инференса LLM упирается в ограничение по шинам передачи данных между GPU — это создает задержки и является узким местом по пропускной способности. C

20 августа 2026, 13:00
Удобный VRAM-калькулятор для быстрого подбора GPU-серверов
Гитара, ручка, хост, воскресенье, фиолетовый, осень, движение — не успели записать? А откуда вы можете знать, что эта информация не понадобится вам завтра? Была бы ручка, успели бы. Все знают эту клас