Меню
AiNews UA
  • AI Hub
  • AI Гуманізатор
  • Каталог інструментів ШІ
  • Перевірка на ші
  • Політика конфіденційності
  • Про нас
  • Умови використання
Пошук
Меню
AiNews UAAiNews UAAiNews UAAiNews UA
Новини AI інструменти Огляди Гайди Порівняння Промпти AI Hub
Підписатися

Що шукаємо?

Новини, AI-інструменти, огляди, гайди та порівняння

Популярне:
ChatGPT Gemini Claude Midjourney AI для бізнесу Генератори зображень

Почніть вводити запит — результати з’являться тут.

    AiNews UAAiNews UAAiNews UA
    Новини AI інструменти Огляди Гайди Порівняння Промпти AI Hub
    Приєднуйтесь до спільноти в Telegram Щоденні AI-новини та добірки
    Українська • © AiNews UA 2026
    Telegram X (Twitter) Facebook LinkedIn

    Alibaba презентує три проривні моделі Qwen: від TTS до мультимодального інтелекту

    Фото автора: Володимир Дрозд Володимир Дрозд
    25 вересня 2025 • 2 хв читання • 262 переглядів
    Alibaba презентує три проривні моделі Qwen: від TTS до мультимодального інтелекту

    Зміст

    1. Розділ
      1. 🔊 Qwen3-TTS-Flash
      2. 🎨 Qwen-Image-Edit-2509
      3. 🌐 Qwen3-Omni — мультимодальна універсальна модель
      4. 🔗 Де спробувати та завантажити
      5. 🌍 Значення для індустрії AI

    Alibaba Qwen представили одразу три нові моделі, кожна з яких робить значний крок у своїй галузі:

    🚀 Introducing Qwen3-Omni — the first natively end-to-end omni-modal AI unifying text, image, audio & video in one model — no modality trade-offs!

    🏆 SOTA on 22/36 audio & AV benchmarks
    🌍 119L text / 19L speech in / 10L speech out
    ⚡ 211ms latency | 🎧 30-min audio… pic.twitter.com/qGn34N7Xvd

    — Qwen (@Alibaba_Qwen) September 22, 2025

    🔊 Qwen3-TTS-Flash

    • Модель для перетворення тексту у голос з акцентом на мінімальну затримку.
    • Підтримує 10 мов і має 14 голосових варіантів.
    • Затримка першого “пакету” складає лише 97 мс.
    • Ідеально підходить для інтерактивних систем: чат-асистентів, голосових ботів, голосового керування.

    🎨 Qwen-Image-Edit-2509

    • Підтримка мультизображень (до 2–3 одночасно).
    • Покращена консистентність обличчя, об’єктів та фону.
    • Інтегрований ControlNet для точнішого контролю пози та структури сцени.
    • Приріст швидкості на 5-10 % у новому текстовому енкодері.
    • Демо доступне у Hugging Face Spaces.

    🌐 Qwen3-Omni — мультимодальна універсальна модель

    Флагманський проєкт Alibaba, що об’єднує роботу з текстом, зображеннями, аудіо та відео.

    • 119 текстових мов, 19 мов розпізнавання мовлення, 10 мов для генерації голосу.
    • У 36 аудіо/відео-бенчмарках здобула лідерство у більшості випадків.
    • Архітектура Thinker–Talker (Mixture-of-Experts) — поєднання логіки та генерації голосу.
    • Обробляє аудіофайли до 30–40 хв у безперервному режимі.
    • “Холодний старт” забезпечує першу відповідь за ~234 мс.

    Доступні три open-source версії:

    • Qwen3-Omni-30B-A3B-Instruct — повнофункціональна модель (текст, аудіо, відео, зображення, відповіді текстом і голосом).
    • Qwen3-Omni-30B-A3B-Thinking — аналітична версія, відповіді лише текстом.
    • Qwen3-Omni-30B-A3B-Captioner — спеціалізація на текстових описах аудіо.

    🔗 Де спробувати та завантажити

    • Chat Qwen
    • GitHub
    • Hugging Face
    • ModelScope
    • Demo

    🌍 Значення для індустрії AI

    Qwen3-Omni став відкритою альтернативою закритим системам на кшталт OpenAI чи Google, оскільки доступний під ліцензією Apache 2.0. Нова архітектура пропонує довший контекст, ширші мультимодальні можливості та баланс між продуктивністю і швидкістю. Це робить Qwen3 важливим етапом у розвитку відкритих моделей штучного інтелекту.

    Рекомендовано

    Інструменти, повʼязані з темою

    HuggingChat Hugging Face AI Score 74 →
    #новини #Штучний інтелект
    Фото автора: Володимир Дрозд

    Автор матеріалу

    Володимир Дрозд

    Володимир Дрозд — засновник та головний редактор AiNews UA. Автор понад 700 публікацій про штучний інтелект, великі мовні моделі (LLM), AI-агентів та сучасні AI-сервіси. Спеціалізується на новинах OpenAI, Google, Anthropic, xAI, Meta та локальних AI-моделях.

    Показати повністю Згорнути
    Усі матеріали автора →
    ← Попередня стаття Kling AI випустила версію 2.5 Turbo: ще більше динаміки та реалістики Наступна стаття Wan 2.5 Preview — революційна мультимодальна модель з інтегрованим аудіо-відео та новими можливостями →

    Зміст статті

    Зміст

    1. Розділ
      1. 🔊 Qwen3-TTS-Flash
      2. 🎨 Qwen-Image-Edit-2509
      3. 🌐 Qwen3-Omni — мультимодальна універсальна модель
      4. 🔗 Де спробувати та завантажити
      5. 🌍 Значення для індустрії AI

    Популярні матеріали

    Топ програм ШІ для створення відео та музики у 2024 Топ програм ШІ для створення відео та музики у 2024 3 728 переглядів Добірка ші для діпфейків за один клік. Змінюємо обличчя на фото Добірка ші для діпфейків за один клік. Змінюємо обличчя на фото 3 240 переглядів Найкращі інструменти для створення логотипів з використанням ШІ: що обрати? Найкращі інструменти для створення логотипів з використанням ШІ: що обрати? 2 899 переглядів GPT-5 OpenAI показали GPT-5 на конференції Microsoft 2 830 переглядів Hedra AI - генератор аватарів, які розмовляють Hedra AI – генератор аватарів, які розмовляють 2 697 переглядів

    Головне про AI українською

    Щоденні новини, добірки й корисні інструменти.

    Читати в Telegram
    Без спаму Швидкі оновлення

    Теми

    новини Штучний інтелект

    Читайте також

    Більше статей →
    Gemini 3.6 Flash
    Штучний інтелект

    Google представила Gemini 3.6 Flash, Flash-Lite та Flash Cyber — що нового

    Google DeepMind офіційно анонсувала одразу три нові моделі сімейства Gemini — Gemini 3.6 Flash, Gemini 3.5 Flash-Lite та спеціалізовану Gemini…

    21.07.2026 • 3 хв читання
    OpenAI представила GPT-5.6 — нове покоління штучного інтелекту
    Штучний інтелект

    OpenAI представила GPT-5.6: моделі Sol, Terra та Luna — що нового

    OpenAI офіційно анонсувала сімейство моделей GPT-5.6, яке включає три окремі варіанти — Sol, Terra та Luna. Компанія змінює підхід до…

    9.07.2026 • 3 хв читання
    OpenAI анонсувала нове сімейство моделей GPT-5.6, до якого входять Sol, Terra та Luna.
    Штучний інтелект

    OpenAI представила GPT-5.6 Sol: нове покоління ШІ для програмування, науки та кібербезпеки

    OpenAI анонсувала нове сімейство моделей штучного інтелекту GPT-5.6, до якого входять три моделі: Sol, Terra та Luna. Флагманська модель GPT-5.6…

    26.06.2026 • 3 хв читання
    AiNews UAAiNews UAAiNews UA

    AiNews UA — перше українське медіа про штучний інтелект. Ми пояснюємо головні ідеї, технології та прориви, що формують майбутнє вже сьогодні.

    Навігація

    • Новини
    • AI інструменти
    • Огляди
    • Гайди
    • Порівняння
    • AI Hub

    Інструменти

    • AI Гуманізатор
    • Перевірка на ШІ
    • Каталог AI-інструментів

    Категорії AI

    • Асистенти
    • Код
    • Бізнес
    • Аудіо
    • Медицина
    • Дані
    • Текст
    • Освіта
    • Зображення та відео
    • Дизайн
    Telegram канал

    Підписка на новини AiNews UA

    Отримуйте найважливіші новини AI та добірки інструментів щотижня.

    Підписатися в Telegram
    Швидкі оновлення Без спаму
    © AiNews UA 2026. Усі права захищені.
    Політика конфіденційності
    Зроблено з ❤️ в Україні 🇺🇦 ↑