Apple представила PICO — нейросетевой кодек для оптимизированного сжатия изображений

1 мин
Apple представила PICO — нейросетевой кодек для оптимизированного сжатия изображений

Исследователи Apple разработали PICO (Perceptual Image Codec) — нейросетевой кодек для сжатия изображений с учётом их содержимого. Система работает в 2-3 раза эффективнее обычных кодеков и быстрее конкурирующих систем на базе ML.

В отличие от стандартных кодеков, в которых алгоритмы сжатия прописан вручную, PICO относится к разряду обучаемых систем. В основе лежит нейросетевая схема для кодирования изображений. Она обучена понимать, какие детали на снимках человеческий глаз не замечает, и удалять их в первую очередь. Благодаря этому изображения удаётся эффективно сжимать с минимальной потерей качества.

По данным разработчиков, PICO выдаёт экономию битрейта в 2-3 раза по сравнению с AV1, AV2, VVC, ECM и JPEG AI при сопоставимом визуальном качестве. Если сравнивать с другими нейросетевым кодеками, то экономия битрейта составляет 20-40%. Одновременно Apple не сравнивает PICO с JPEG XL.

Отдельно компания обращает внимание на скорость работы. На iPhone 17 Pro Max PICO кодирует 12-мегапиксельное изображение приблизительно за 230 мс и декодирует его за 150 мс. Apple отмечает, что обычно ML-кодеки работают на GPU Nvidia V100, что значительно усложняет их перенос на мобильное железо.

Пока проект больше похож на исследовательскую работу, а о планах внедрить PICO в операционные системы Apple или iCloud пока неизвестно. Вероятно, подробностями организация поделится на WWDC в начале июня.

Читают сейчас

33 минуты назад

Операционная платформа «Альт Образование» бесплатна для школ — акция от «Базальт СПО»

Операционная платформа «Альт Образование» бесплатна для школ — акция от «Базальт СПО» Организация «Базальт СПО» запускает специальное предложение для школ: операционная система «Альт Образование» 11 п

Google добавила агентный аналитика видео в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite

42 минуты назад

Google добавила агентный аналитика видео в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite

Google запустила агентный анализ видео для Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite. Теперь модель анализирует видео не как последовательность кадров с фиксированной частотой, а сама решает, какие

Апдейт платформы «Октопус» от ГК «Юзтех»: историческая анализ и расширенная сопровождение инфраструктур

1 час назад

Апдейт платформы «Октопус» от ГК «Юзтех»: историческая анализ и расширенная сопровождение инфраструктур

В новых версиях «Октопус» мы сфокусировались на трёх направлениях: расширении возможностей управления ИТ-инфраструктурой, повышении производительности и развитии интеграций. Система получила новые сце

Frank Media рассказал о сложностях, с которыми столкнулись пользователи при попытке воспользоваться цифровым рублём

1 час назад

Frank Media рассказал о сложностях, с которыми столкнулись пользователи при попытке воспользоваться цифровым рублём

С 1 сентября должно было начаться массовое добавление цифрового рубля — третьей формы денег, которую Банк России обсуждает уже около шести лет. Тем не менее, судя по первым дням запуска, доступ к ново

2 часа назад

Digital Q.Sensor BI от «Диасофт» модернизировал ИИ-агента: визуальные правки дашбордов без доступа к данным

«Диасофт» представил обновленные возможности ИИ-агента платформы Digital Q.Sensor BI: теперь он может вносить правки в готовый дашборд, ориентируясь в том числе на его визуальное отображение. ИИ-агент