Тег: распознавание речи
VS Code получил встроенную функцию распознавания речи с локальным ИИ
Редактор кода VS Code добавил встроенную функцию диктовки, работающую полностью локально. Для обработки речи используется модель Nemotron 3.5 ASR Streaming 0.6B.
Meta представила Muse Voice Transcribe для обработки речи в реальном времени
Meta представила модель Muse Voice Transcribe, способную транскрибировать аудио в реальном времени, распознавать до 20 спикеров и переключаться между 70 языками.
Новая модель GigaChat Audio распознаёт эмоции и анализирует длинные записи
Сбер представил GigaChat Audio: модель, которая распознаёт эмоции, анализирует трехчасовые записи без перевода в текст и обладает долговременной памятью.
Яндекс обновил приложение «Разговор» — теперь оно распознает речь без интернета
Яндекс значительно обновил приложение «Разговор», добавив офлайн-распознавание речи, новые режимы «Диалог» и «Монолог», поддержку английского языка и возможности для архивации записей.
Вышли whisper.cpp 1.9.0 и 1.9.1: поддержка NVIDIA Parakeet и улучшения ffmpeg
Разработчики whisper.cpp выпустили обновления 1.9.0 и 1.9.1, добавив поддержку NVIDIA Parakeet и оптимизировав работу с библиотекой ffmpeg.
Canonical представила Myna — локальную систему преобразования речи в текст для...
Canonical разрабатывает систему локальной диктовки Myna для Ubuntu Desktop. Инструмент обещает полную приватность, работу без интернета и интеграцию с Wayland.
xAI запустила Grok Speech to Text: транскрипция на 25 языках по...
Компания xAI Илона Маска представила API для распознавания речи Grok Speech to Text. Сервис поддерживает 25 языков, включая русский, и предлагает самые выгодные тарифы на рынке.


_large.jpg)



