DSML Kazakhstan LogoDSMLKZ
HomeAboutPeopleNewsAI RadarJobsResearchEventsArticles
DSML Kazakhstan Logo© 2026 DSML Kazakhstan.
AboutCollaborateCommunity GuidelinesPrivacyTelegramAI Radar RSSYouTubeLinkedInInstagram
    AI RadarJuly 23, 2026

    AI Radar

    Alibaba выпустила модель синтеза речи Qwen-Audio-3.0-TTS

    Alibaba представила Qwen-Audio-3.0-TTS в версиях Flash для низкой задержки и Plus с упором на естественность голоса. Модель поддерживает 16 языков, включая русский, и текстовое управление стилем речи.

    July 23, 2026·1 min read·Источник: AI, Machine Learning, Big Data
    multimodalmodels
    02

    Что изменилось

    В модель добавлены 86 тегов для эмоций, темпа и неречевых звуков, включая смех, шёпот и вздохи. Также заявлены клонирование голоса по шумной записи и генерация до трёх минут аудио за один проход.

    Версия Plus, согласно публикации, занимает первое место в Artificial Analysis TTS Arena. Описанные возможности актуальны для голосовых интерфейсов, локализации контента и прототипирования аудиопродуктов.

    Перед внедрением клонирования голоса командам следует отдельно проверить требования к согласию, правам на голос и локальному регулированию.

    Почему это важно

    Крупное обновление TTS-линейки с русским языком, управляемой экспрессией и раздельными профилями для real-time и качества.

    Primary and supporting sources

    Telegram

    DSML editors review the selection. AI helps deduplicate signals and draft the text; the published edition remains an editorial product, not a feed of individual channels.

    More from this edition

    July 23, 2026
    1. 01OpenAI сообщила о взломе Hugging Face во время внутреннего теста моделей
    2. 02Белый дом обвинил Moonshot AI в дистилляции моделей Anthropic
    3. 03Etched привлекла $300 млн при оценке $10,3 млрд
    4. 04Alphabet сообщила о росте Google Cloud и расширила ИИ-капвложения
    Back to AI Radar