Домой ИИ и технологии Xiaomi представила три модели ИИ: MiMo-V2-Pro, MiMo-V2-Omni и MiMo-V2-TTS

Xiaomi представила три модели ИИ: MiMo-V2-Pro, MiMo-V2-Omni и MiMo-V2-TTS

Флагманская модель для эры агентов, мультимодальный анализ и продвинутый синтез речи с поддержкой диалектов.

7
0

Компания Xiaomi расширила свой инструментарий в сфере машинного обучения, представив три новые модели: MiMo-V2-Pro, MiMo-V2-Omni и MiMo-V2-TTS. Новинки уже внедрены в фирменную экосистему, включая приложение MiMo Studio, мобильный браузер Xiaomi и пакет Kingsoft Office. Для сторонних разработчиков компания открыла доступ к API через платформы OpenClaw, OpenCode и Cline, предложив неделю бесплатного пробного периода.

Флагманские возможности MiMo-V2-Pro

Модель MiMo-V2-Pro позиционируется как ключевой продукт Xiaomi для «эры агентов». Система спроектирована для выполнения ресурсоемких задач в реальных условиях. Основные технические параметры включают более 1 ТБ общего объема параметров и внушительное контекстное окно размером 1 МБ.

По заявлениям разработчиков, MiMo-V2-Pro способна автономно выстраивать сложные рабочие процессы и заниматься долгосрочным планированием. Производительность модели сопоставима с уровнем Claude Opus 4.6, однако стоимость обращения к API значительно доступнее: цена стартует от 1 доллара за миллион токенов при обработке небольших контекстов, с прогрессивным повышением для более объемных запросов.

Xiaomi представила три модели ИИ: MiMo-V2-Pro, MiMo-V2-Omni и MiMo-V2-TTS
Xiaomi представила три модели ИИ: MiMo-V2-Pro, MiMo-V2-Omni и MiMo-V2-TTS — иллюстрация к материалу. Источник: ixbt.com

Модель уже интегрирована в инструменты WPS Office (Kingsoft), что позволяет автоматизировать работу с текстовыми документами Word, таблицами Excel, презентациями PowerPoint и PDF-файлами.

Мультимодальность: MiMo-V2-Omni и MiMo-V2-TTS

Модель MiMo-V2-Omni ориентирована на мультимодальные сценарии. Она способна одновременно анализировать аудио, видео и графические данные. Высокие показатели скорости и точности демонстрируются в задачах визуального мышления и распознавания звуковых потоков. Xiaomi заявляет, что в ряде тестов по обработке аудиосигналов новинка превосходит возможности Gemini 3 Pro.

Отдельное решение MiMo-V2-TTS предназначено для синтеза речи. Пользователям доступны широкие возможности настройки: от выбора интонации и эмоционального окраса до специфических стилей звучания. Модель поддерживает различные китайские диалекты и способна генерировать как естественную человеческую речь, так и вокальное исполнение песен.

Эволюция ИИ-решений Xiaomi

Напомним, что путь в этой сфере Xiaomi начала в прошлом году с запуска своей первой крупной языковой модели с открытым кодом MiMo, которая была сфокусирована на математическом и логическом анализе. Параллельно с успехами китайского гиганта, прогресс демонстрируют и другие игроки рынка: например, Илон Маск недавно анонсировал планы xAI по одновременному обучению трех различных версий модели Grok.

Источник: https://www.ixbt.com