27 июля 2026, 12:19
Microsoft представила две новые модели MAI и постепенно заменяет ими OpenAI в собственных сервисах
Microsoft AI анонсировала две новые модели: MAI‑Image-2.5-Pro для генерации изображений и MAI‑Voice-2-Flash для синтеза речи. Обе уже доступны разработчикам через Azure AI Foundry и песочницу MAI Play

23 июля 2026, 17:35
Qwen-Audio-3.0-TTS: что в релизе Alibaba уже работает, а что пока обещание
Команда Qwen выкатила Qwen-Audio-3.0-TTS - облачную схема Alibaba для синтеза речи, сразу в двух версиях: Flash под низкую задержку и Plus под качество тембра. В анонсе много громких чисел: 16 языков

19 июня 2026, 18:35
3800 часов с нейроимплантом: как пациент с БАС превратил эксперимент в рабочий средство
Речевые нейроинтерфейсы выходят из стадии эффектных лабораторных демо: опубликован кейс Кейси Харрелла, человека с БАС, который почти два года использует имплант дома — пишет письма, управляет курсоро
9 июня 2026, 11:40
«Яндекс Книги» запустили виртуальную озвучку книг по ролям
Цифровой рассказчик в «Яндекс Книгах» научился озвучивать реплики разными голосами. Свежий режим «По ролям», в основе которого лежит разработанная в компании технология синтеза речи, уже доступен для

16 апреля 2026, 16:04
Gemini 3.1 Flash TTS: Google представила новую схема синтеза речи с управлением через текст
Голосовые модели постепенно уходят от простого «озвучить текст» к более управляемым сценариям, где важны интонация, темп и поведение в диалоге. В новом релизе Gemini 3.1 Flash TTS Google делает акцент