
17 августа 2026, 14:52
Cohere выпустила North Micro Vision — компактную VLM на 2,4 млрд параметров
Cohere Labs выпустила North Micro Vision — компактную vision-language model (VLM) с 2,4 млрд параметров. Это самая маленькая зрительно-языковая модель компании на момент релиза. Основной сценарий Nort

10 августа 2026, 18:37
Qwen релизнули мультимодальный tool layer для ИИ‑агентов
Команда Qwen выпустила Qwen-MM-Plugins — публичный мультимодальный tool layer, который позволяет подключать зрение, OCR, обработку видео и аудио к любому агентному окружению в виде отдельных плагинов.

8 июля 2026, 15:17
Content AI выпустила кросс-платформенную версию PassportReader 2.0 с веб-интерфейсом и выбором скорости распознавания
Организация Content AI представила кросс-платформенную версию SDK-модуля PassportReader 2.0 для извлечения данных из документов, удостоверяющих личность. Ознакомиться далее

30 апреля 2026, 11:08
Smart Engines добавила распознавание цифровых документов с «Госуслуг» в Smart Document Engine 3.4
Smart Engines обновила систему Smart Document Engine до версии 3.4 и добавила распознавание документов, которые изначально созданы в электронной среде. Речь идёт не о сканах бумажных документов, а о b

1 апреля 2026, 12:05
Почему PDF в России превратился в проблему для документооборота и ИИ
После массового перехода на разное отечественное ПО PDF в России из «финального» формата неожиданно стал рабочим. Если раньше документ создавали в одной экосистеме, согласовывали там же, а PDF использ

4 марта 2026, 20:24
Превращаем Видео-уроки в навыки для Claude и других с помощью одного инструмента
Наткнулась на мощный open-source средство, который помогает быстро запаковать знания из видеоуроков в структура для Claude, Gemini, OpenAI, RAG-пайплайнов и AI-coding ассистентов. К тому же, он уже ум