
28 августа 2026, 12:00
Ответ Blackwell: OpenAI раскрыла характеристики собственного инференс-ASIC Jalapeño
На Hot Chips 2026 OpenAI и Broadcom в начальный раз раскрыли цифры по Jalapeño — собственному ASIC компании для инференса. Заявка крупная: прирасти в 1,5–1,9 раз по пропускной способности и 1,7–3,6 по

27 августа 2026, 16:30
Зачем пересылать гигабайты? Как Samsung встроила вычисления прямо в банки памяти LPDDR5X-PIM
На Hot Chips 2026 Samsung представила LPDDR5X-PIM — внешне обычную LPDDR5X, внутри которой в каждом банке стоят MAC-деревья. На инференсе Llama 3.1 8B это дало х3,01 по токенам в секунду (81,3 против

26 августа 2026, 11:23
Процессор OpenAI разогнал Kimi K2.5 почти до 700 токенов в секунду
В июне OpenAI и Broadcom представили Jalapeño, первый собственный чип OpenAI для инференса языковых моделей. Тогда компании рассказывали в основном про архитектуру и обещали начать развёртывание до ко

13 августа 2026, 22:31
OpenAI и Cerebras разогнали GPT-5.6 Sol до 750 токенов в секунду
OpenAI и Cerebras представили Ultrafast, новый режим обработки запросов GPT-5.6 Sol в OpenAI api. Он генерирует до 750 выходных токенов в секунду и работает до 14 раз быстрее Standard processing. Это

8 июля 2026, 10:58
DeepSeek тайно собирает команду для собственного чипа — вслед за OpenAI и Anthropic
DeepSeek, год назад взорвавший рынок своей R1-моделью, начал разработку собственного чипа для инференса. Проект запущен приблизительно года назад, но только сейчас стал достоянием общественности. Проц

29 мая 2026, 12:48
ИИ-токены могут стать новым биржевым товаром: Китай готовит фьючерсы на стоимость инференса
Китайская Shanghai Futures Exchange разрабатывает рынок деривативов на AI-токены — единицы, в которых современные языковые модели считают входные и выходные данные. Если инициатива дойдёт до запуска,

15 мая 2026, 11:30
Cerebras провела крупнейшее AI-IPO 2026 года: акции взлетели на 108% в начальный день торгов
Cerebras Systems провела одно из самых заметных технологических IPO 2026 года. Организация, которая разрабатывает специализированные AI-чипы и конкурирует с Nvidia в сегменте вычислений для искусствен

6 мая 2026, 12:23
Представлена языковая схема с линейной сложностью вычислений и контекстом до 12 млн токенов
Стартап-компания Subquadratic представил SubQ 1M-Preview — первую языковую модель с линейной сложностью вычислений по сравнению с длины контекста. Заявлены контекст до 12 млн токенов, скорость в 52 ра

28 апреля 2026, 13:42
Расходы на ИИ становятся отдельной проблемой для бизнеса: токены и вычисления могут стоить дороже сотрудников
Компании всё чаще сталкиваются с неожиданной стороной внедрения ИИ: экономия на людях не всегда означает снижение расходов. В ряде команд затраты на вычисления, api и токены уже становятся сопоставимы