• Новости
  • Генерация изображений
  • Генерация видео
  • Генерация текста
  • Генерация звука
  • Обзор сервисов
AITechWorld
Самые важные события в мире искусственного интеллекта
Автор

admin

admin

    Новости

    Mistral выпустила Open Source TTS‑модель Voxtral для голосовых ассистентов и корпоративных клиентов

    admin 13.09.2026


    Французская Mistral в четверг выпустила новую модель синтеза речи с открытым исходным кодом, которую можно использовать голосовыми ИИ-ассистентами или в корпоративных сценариях, например в службе поддержки. Модель, позволяющая компаниям создавать голосовых агентов для продаж и взаимодействия с клиентами, выводит Mistral в прямую конкуренцию с такими игроками, как ElevenLabs, Deepgram и OpenAI.

    Новая модель, получившая название Voxtral TTS, поддерживает девять языков, включая английский, французский, немецкий, испанский, нидерландский, португальский, итальянский, хинди и арабский.

    «Наши клиенты просили модель речи. Поэтому мы создали малогабаритную модель речи, которая может поместиться на смарт-часах, смартфоне, ноутбуке или других периферийных устройствах. Её стоимость — лишь доля от всего остального на рынке, при этом она обеспечивает производительность на уровне передовых решений», — рассказал Пьер Сток, вице-президент по научным операционным вопросам в Mistral AI.

    Mistral заявила, что новая модель может адаптировать пользовательский голос по образцу длительностью менее пяти секунд и способна воспроизводить такие характеристики, как тонкие акценты, модуляции, интонации и неровности речевого потока. Модель, основанная на Ministral 3B, может легко переключаться между языками, не теряя особенностей голоса, что полезно для таких сценариев, как дубляж или перевод в реальном времени. По словам Стока, компания хотела, чтобы модель звучала по-человечески, а не роботизированно.

    По данным компании, модель создана для работы в реальном времени. Её показатель time-to-first-audio (TTFA) — метрика, отражающая, когда модель начинает «говорить» после получения входных данных, — составляет 90 мс для 10-секундного образца объёмом 500 символов. У модели также есть real-time factor (RTF) 6x, то есть она может сгенерировать 10-секундный фрагмент примерно за 1,6 секунды.

    Ранее в этом году Mistral представила пару моделей транскрибации: одну для пакетной обработки больших объёмов, а другую — для сценариев реального времени с низкой задержкой. С новой речевой моделью компания, вероятно, стремится предоставить предприятиям полный набор голосовых продуктов.

    «Мы планируем создать сквозную платформу, которая сможет обрабатывать мультимодальные потоки входных данных, включая аудио, текст и изображение, а также формировать выходные данные. Главное преимущество в том, что в сквозной агентной системе, поддерживающей аудио как вход или выход, вы получаете гораздо больше информации», — сказал Сток.

    Позиционирование Mistral заключается в том, что её подход с открытым исходным кодом и возможностями кастомизации поможет предприятиям выбирать её голосовые модели вместо решений конкурентов, поскольку их можно настраивать так, как нужно.

    Источник: TechCrunch



    Источник

    13.09.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Генерация звука

    ElevenLabs выпустила Music v2.5 с улучшенным звуком и точным следованием запросу

    admin 13.09.2026
    13.09.2026

    ElevenLabs представила Music v2.5 — новую версию модели для генерации музыки. Она создаёт более многослойные композиции, точнее следует текстовому запросу …

    0 VKOdnoklassnikiEmail
  • Новости

    OpenAI отключает Cursor от своих моделей после покупки редактора компанией SpaceX

    admin 13.09.2026
    13.09.2026

    OpenAI отключит редактор Cursor от своих моделей 12 ноября. Поводом стала покупка Cursor компанией SpaceX — соблюдение условий использования компаниями …

    0 VKOdnoklassnikiEmail
  • Новости

    Википедия ужесточает правила использования ИИ при написании статей

    admin 12.09.2026
    12.09.2026

    По мере того как ИИ все активнее проникает в редакционную и медийную сферы, сайты спешно пытаются установить основные правила его …

    0 VKOdnoklassnikiEmail
  • Новости

    Суд отменил статус угрозы безопасности, который Пентагон присвоил Anthropic

    admin 12.09.2026
    12.09.2026

    Федеральный суд в Калифорнии отменил присвоенный Anthropic статус угрозы для цепочки поставок — метку, из-за которой госорганы США прекратили работать …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Cerebras Systems подала заявку на IPO после крупных сделок с OpenAI и AWS

    admin 12.09.2026
    12.09.2026

    Компания Cerebras Systems, стартап, разрабатывающий, по словам генерального директора Эндрю Фельдмана, «самое быстрое оборудование для обучения и вывода ИИ», подала …

    0 VKOdnoklassnikiEmail
  • Новости

    Cohere выпустила голосовую модель с открытым исходным кодом для транскрибации

    admin 11.09.2026
    11.09.2026

    Корпоративная ИИ-компания Cohere представила свою первую голосовую модель: Transcribe — это модель автоматического распознавания речи с открытым исходным кодом, которую …

    0 VKOdnoklassnikiEmail
  • Генерация звука

    Universal Music и ElevenLabs запустят музыкальную ИИ-платформу

    admin 11.09.2026
    11.09.2026

    Universal Music Group и ElevenLabs заключили многолетнее лицензионное соглашение. Его первый продукт — платформа для создания ремиксов, мэшапов и новых …

    0 VKOdnoklassnikiEmail
  • Генерация текста

    ИИ-агенты OpenAI взломали заброшенные сайты, чтобы тайно общаться друг с другом

    admin 11.09.2026
    11.09.2026

    ИИ-агенты OpenAI в начале 2026 года использовали больше 10 сайтов для несанкционированного обмена сообщениями, пишет Reuters. Следы активности обнаружили шесть …

    0 VKOdnoklassnikiEmail
  • Новости

    Яндекс запустил оператора «Яндекс Сим» с ИИ, который разбирает звонки и обрывает мошенников

    admin 11.09.2026
    11.09.2026

    Яндекс запустил виртуального оператора «Яндекс Сим» на сети Билайна. ИИ-помощник с согласия владельца расшифровывает разговоры, заводит по ним напоминания и …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Encyclopedia Britannica и Merriam‑Webster подали в суд на OpenAI из‑за нарушения авторских прав
  • Google пустила Gemini в полные тексты книг — по одной купленной копии на читателя
  • Picsart представила маркетплейс ИИ-агентов для создателей контента и продавцов
  • Разработчики Crimson Desert признали использование ИИ-арта и пообещали заменить его
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Encyclopedia Britannica и Merriam‑Webster подали в суд на OpenAI из‑за нарушения авторских прав

    16.09.2026
  • Google пустила Gemini в полные тексты книг — по одной купленной копии на читателя

    16.09.2026
  • Picsart представила маркетплейс ИИ-агентов для создателей контента и продавцов

    16.09.2026
  • Разработчики Crimson Desert признали использование ИИ-арта и пообещали заменить его

    16.09.2026
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

    15.09.2026
  • OpenAI покажет человекоподобного робота в 2027 году

    15.09.2026

Рубрики

  • Генерация видео (113)
  • Генерация звука (23)
  • Генерация изображений (87)
  • Генерация текста (68)
  • Новости (112)
  • Обзор сервисов (75)

Encyclopedia Britannica и Merriam‑Webster подали в суд на...

16.09.2026

Google пустила Gemini в полные тексты книг —...

16.09.2026

Picsart представила маркетплейс ИИ-агентов для создателей контента и...

16.09.2026

Разработчики Crimson Desert признали использование ИИ-арта и пообещали...

16.09.2026

ElevenLabs добавила генерацию речи, музыки, изображений и видео...

15.09.2026

Обзоры

  • Picsart представила маркетплейс ИИ-агентов для создателей контента и продавцов

    16.09.2026
  • Разработчики Crimson Desert признали использование ИИ-арта и пообещали заменить его

    16.09.2026
  • Google выпустила Lyria 3 Pro: генерация музыкальных треков до 3 минут и расширенная кастомизация

    14.09.2026

Выбор редакции

  • OpenAI выпустила приложение Sora на Android — пока только в 7 странах

    19.06.2026
  • Substack будет проверять тексты на признаки использования ИИ

    15.08.2026
  • Администрация Трампа сняла ограничения с новейших ИИ-моделей Anthropic

    25.08.2026

Популярное

  • 1

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 2

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026 - aitechworld.ru


Наверх
AITechWorld
  • Новости
  • Генерация изображений
  • Генерация видео
  • Генерация текста
  • Генерация звука
  • Обзор сервисов