• Новости
  • Генерация изображений
  • Генерация видео
  • Генерация текста
  • Генерация звука
  • Обзор сервисов
AITechWorld
Самые важные события в мире искусственного интеллекта
Категория:

Генерация видео

    Генерация видео

    MiniMax выпустила видеомодель H3 — ролики в 2K со звуком

    admin 10.08.2026


    MiniMax 31 июля представила H3 — мультимодальную видеомодель, которая принимает текст, изображения, видео и звук и выдаёт ролики до 15 секунд в 2K с нативным стереозвуком. Модель уже работает через API, а веса компания обещает открыть в ближайшие дни.

    Содержание

    1. Один запрос вместо четырёх режимов
    2. 2K по умолчанию, от 4 до 15 секунд
    3. Цена как главный аргумент MiniMax
    4. H3-VAE и регенерация вместо апскейла
    5. Открытые веса обещаны «в ближайшие дни»
    6. Реклама, товарные карточки и заставки
    7. Всё упирается в дату публикации весов

    MiniMax — китайская компания, известная по линейке видеомоделей Hailuo (Хайлуо) и текстовым моделям серии M. H3 продолжает эту линию: в документации API модель проходит под рабочим именем Hailuo-03, но в публичном анонсе название сменили. Компания подаёт релиз как попытку убрать границы между отдельными режимами генерации и заодно вернуть видеомодели в открытый доступ.

    Один запрос вместо четырёх режимов

    До сих пор видеогенерация была разбита на отдельные задачи: текст в видео, картинка в видео, первый и последний кадр, перенос движения, референс по персонажу, редактирование. Под каждую обычно шла своя модель или свой режим. H3 принимает всё это в одном запросе — текст, изображения, ролики и аудио складываются в общий контекст, а связь между ними описывается обычными словами.

    Пример из анонса MiniMax выглядит так: «Возьми движение камеры из видео 1, пусть персонаж с изображения 2 поёт, а голос совпадает с аудио 3». Модель сама разбирается, что здесь референс движения, что источник внешности, а что образец голоса. Отдельных переключателей режима нет.

    2K по умолчанию, от 4 до 15 секунд

    В API H3 доступна асинхронно: запрос возвращает идентификатор задачи, готовый ролик забирается отдельным вызовом. Разрешение сейчас одно — 2K. Длительность задаётся целым числом секунд в диапазоне от 4 до 15. Пропорции кадра выбираются из набора 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 либо подбираются автоматически под входной материал.

    Ограничения на вход у MiniMax довольно щедрые:

    • до 9 референсных изображений, до 3 референсных видео и до 3 аудиодорожек в одном запросе;
    • каждый референсный клип от 2 до 15 секунд, суммарно не больше 15;
    • изображение до 30 МБ, видео до 50 МБ, аудио до 15 МБ, всё тело запроса до 64 МБ.

    Текстовый промпт обязателен всегда, даже когда основную работу делают референсы. Аудио отдельно, без картинки или видео, модель не примет.

    Цена как главный аргумент MiniMax

    Экономику MiniMax описывает в относительных величинах: секунда в 2K обходится меньше трети от цены основных конкурентов, а в 768p — меньше половины от их же 720p. Абсолютных цифр в анонсе нет, конкретные модели для сравнения не названы.

    Здесь нужно оговориться. Режим 768p упомянут в тексте про цены, но в самой документации API разрешение пока предлагается только одно, 2K. Либо более дешёвый режим появится позже, либо сравнение приведено для внутренних расчётов. Проверить утверждение о цене на своей задаче получится не раньше, чем откроется второй режим или появится публичный прайс-лист.

    H3-VAE и регенерация вместо апскейла

    Техническая часть у MiniMax держится на нескольких решениях. Новый токенизатор H3-VAE даёт четырёхкратный выигрыш по эффективной длине последовательности, и именно он позволяет считать 2K нативно, а не догонять разрешение постобработкой. Архитектура H3-Omni Transformer разводит вычисления на понимание и на генерацию по разным контурам, что подняло пропускную способность обучения почти на 30%.

    Самое любопытное решение — отказ от отдельного модуля апскейла. Вместо него H3 заново генерирует собственный черновик низкого разрешения, снова опираясь на исходный контекст. По замыслу MiniMax это возвращает мелкие детали и текст на вывесках, которые обычный увеличитель разрешения способен только додумать. Полный технический отчёт компания обещает опубликовать позже.

    Открытые веса обещаны «в ближайшие дни»

    Видеогенерация до сих пор остаётся вотчиной закрытых моделей — открытых релизов сопоставимого уровня почти нет, и экосистема вокруг них развивается медленнее, чем вокруг языковых моделей. MiniMax собирается выложить веса H3 «в ближайшие дни, с учётом применимого законодательства». Формулировка осторожная, срок мягкий, но совместимость с разным железом компания закладывала в архитектуру с самого начала.

    Если обещание выполнят, H3 станет одной из первых крупных открытых моделей для мультимодальной генерации видео. Развернуть её у себя и дообучить под конкретную нишу — сценарий, которого рынку сейчас не хватает больше, чем очередного роста качества.

    Реклама, товарные карточки и заставки

    Целевые сценарии MiniMax называет прямо: реклама, брендинг, электронная коммерция, промышленный дизайн, интерфейсы, игры. В демонстрациях — киношные титры, промо-ролик для сайта продукта, оживший постер и рекламные вставки для магазина. Отдельно компания подчёркивает аккуратную отрисовку текста и логотипов, что для товарной съёмки важнее эффектных планов.

    Подбор примеров говорит о приоритетах. H3 продают не как инструмент для авторского кино, а как рабочую лошадь для контента, который производят пачками и по техзаданию.

    Всё упирается в дату публикации весов

    Заявленные MiniMax цифры пока опираются только на собственные тесты компании: независимых замеров качества и сравнений с конкурентами нет, абсолютных цен тоже. Ближайшая проверочная точка — выкладка весов. Появятся они в течение недели-двух, и у сообщества будет чем мерить; затянется срок или изменится формулировка про «применимое законодательство» — и H3 останется ещё одним API среди прочих, с хорошим прайсом и обычной для отрасли закрытостью.



    Источник

    10.08.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Генерация видео

    Революционная платформа KLING AI для генерации видео теперь доступна каждому

    admin 01.08.2026
    01.08.2026

    Китайская платформа KLING AI, которая нашумела благодаря своим выдающимся возможностям генерации видео, теперь открыта для всех без необходимости телефонной верификации. …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом

    admin 30.07.2026
    30.07.2026

    Firefly Video Model теперь могут протестировать все желающие. Этот инструмент позволяет создавать 5-секундные видеоролики в 1080p на основе текстовых описаний …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Google Veo 2 дебютировал на Freepik: новая эра в создании видео с помощью ИИ

    admin 29.07.2026
    29.07.2026

    Платформа Freepik первой в мире внедрила Google Veo 2 — новую модель генерации видео от Google DeepMind. Интеграция этой технологии …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Pika Labs представляет Pika 2.2: Новая эра в AI-видеогенерации с 10-секундными клипами

    admin 28.07.2026
    28.07.2026

    Pika Labs снова удивляет мир искусственного интеллекта: новая модель Pika 2.2 поднимает планку возможностей AI-видеогенерации, предлагая пользователям более длинные и …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    HeyGen представил обновление AI-аватаров: теперь еще реалистичнее

    admin 27.07.2026
    27.07.2026

    Компания HeyGen, известная своими решениями для генерации видео с искусственным интеллектом, обновила технологию UGC (User-Generated Content) AI-аватаров. Теперь виртуальные персонажи …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Новая модель Runway Gen-4: реалистичные видео и полный контроль над сюжетом

    admin 26.07.2026
    26.07.2026

    Gen-4 предлагает более высокую реалистичность, согласованность и контроль над визуальным повествованием. Новая технология уже доступна подписчикам и открывает новые горизонты …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Higgsfield AI анонсировала Higgsfield Mix: новый инструмент для создания кинематографических видео

    admin 25.07.2026
    25.07.2026

    Компания Higgsfield AI представила инструмент Higgsfield Mix, позволяющий создавать невозможные с точки зрения физики движения камеры в видео. Новинка открывает …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Kling 2.0 открывает новую главу в генерации визуального контента

    admin 24.07.2026
    24.07.2026

    Китайская платформа Kling 2.0 от Kuaishou выходит на новый уровень: искусственный интеллект научился создавать видео и изображения с кинематографическим качеством …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    ​Искусство за восемь секунд: Google запустила генерацию видео в Gemini и Whisk

    admin 23.07.2026
    23.07.2026

    Компания Google представила новую функцию для подписчиков сервиса Gemini Advanced — возможность создавать восьмисекундные видеоролики по текстовым запросам с помощью …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Grokipedia и ИИ‑арбитр с сомнительной этикой: нейтральность на плечах алгоритма
  • Экспериментальный ИИ-инструмент Telex от WordPress уже применяется на практике
  • Министерство здравоохранения США представило стратегию расширенного внедрения ИИ
  • OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный режим в API
  • Chicago Tribune подала в суд на Perplexity за нарушение авторских прав

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Grokipedia и ИИ‑арбитр с сомнительной этикой: нейтральность на плечах алгоритма

    11.10.2026
  • Экспериментальный ИИ-инструмент Telex от WordPress уже применяется на практике

    11.10.2026
  • Министерство здравоохранения США представило стратегию расширенного внедрения ИИ

    11.10.2026
  • OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный режим в API

    10.10.2026
  • Chicago Tribune подала в суд на Perplexity за нарушение авторских прав

    09.10.2026
  • Gemini опережает ChatGPT по темпам роста и вовлечённости

    09.10.2026

Рубрики

  • Генерация видео (116)
  • Генерация звука (25)
  • Генерация изображений (89)
  • Генерация текста (78)
  • Новости (134)
  • Обзор сервисов (113)

Grokipedia и ИИ‑арбитр с сомнительной этикой: нейтральность на...

11.10.2026

Экспериментальный ИИ-инструмент Telex от WordPress уже применяется на...

11.10.2026

Министерство здравоохранения США представило стратегию расширенного внедрения ИИ

11.10.2026

OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный...

10.10.2026

Chicago Tribune подала в суд на Perplexity за...

09.10.2026

Обзоры

  • Grokipedia и ИИ‑арбитр с сомнительной этикой: нейтральность на плечах алгоритма

    11.10.2026
  • Экспериментальный ИИ-инструмент Telex от WordPress уже применяется на практике

    11.10.2026
  • Chicago Tribune подала в суд на Perplexity за нарушение авторских прав

    09.10.2026

Выбор редакции

  • Qwen выпустила Qwen-Image-3.0 — модель генерирует сложные макеты и текст от 10 пикселей

    22.07.2026
  • OpenAI закрывает браузер Atlas и переносит его ИИ-функции в ChatGPT и Chrome

    20.08.2026
  • Нейросеть будет «следить» за мусорными полигонами России

    31.07.2026

Популярное

  • 1

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 2

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026 - aitechworld.ru


Наверх
AITechWorld
  • Новости
  • Генерация изображений
  • Генерация видео
  • Генерация текста
  • Генерация звука
  • Обзор сервисов