• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
AITopGuide
Новости нейросетей и полезная информация об ИИ
Категория:

Генерация звука

    Генерация звука

    ElevenLabs запустила Scribe v2 Realtime — ИИ для распознавания речи в режиме реального времени

    admin 22.06.2026


    Компания ElevenLabs представила обновлённую систему для распознавания речи — Scribe v2 Realtime.

    ИИ-модель расшифровывает речь с минимальной задержкой (менее 150 мс) и, по заявлению разработчиков, превосходит решения Google, OpenAI и Deepgram по точности в режиме «живого» аудио. Postium собрал больше деталей.

    Что умеет Scribe v2 Realtime и как работает

    Нейросеть Scribe v2 Realtime способна:

    • распознавать речь даже при шуме, акцентах и быстрой смене говорящих;
    • автоматически определять язык и переключаться между несколькими (например, английским, хинди, польским, японским и другими);
    • «предугадывать» слова и корректировать текст по ходу разговора — транскрипция становится точнее прямо во время речи;
    • работать с задержкой менее 150 миллисекунд;
    • соответствовать промышленным стандартам безопасности — SOC 2, HIPAA, PCI DSS и другим.

    Модель предназначена для задач, где важны скорость и точность: автоматическая расшифровка звонков в продажах и поддержке клиентов, субтитры для стримов и мероприятий, а также ускоренная обработка интервью и подкастов.

    Первая версия Scribe уже показала себя как одна из самых точных систем распознавания речи. Теперь ElevenLabs делает акцент на распознавании в режиме лайв. Компания утверждает, что по внутренним тестам новая версия опережает конкурентов по качеству распознавания, особенно при сложных аудиозаписях с шумом или несколькими голосами одновременно.

    Доступность: Scribe v2 Realtime уже доступна через API ElevenLabs и может использоваться в коммерческих продуктах. Платформа поддерживает десятки языков и предлагает корпоративные опции с расширенными гарантиями безопасности и хранением данных в выбранных регионах.

    Итог: ElevenLabs делает серьёзную заявку на лидерство в области живой транскрипции — Scribe v2 Realtime превращает поток речи в чистый текст почти мгновенно и без потерь в точности.

    Ранее ElevenLabs запустила ИИ-редактор Studio 3.0, который объединяет все ключевые инструменты платформы.



    Источник

    22.06.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Генерация звука

    ElevenLabs запустила раздел «Image & Video» — генерацию изображений и видео на своей платформе

    admin 21.06.2026
    21.06.2026

    ElevenLabs добавила новую вкладку «Image & Video (Beta)», где пользователи могут генерировать картинки и видеоролики прямо в интерфейсе ElevenLabs, а …

    0 VKOdnoklassnikiEmail
  • Генерация звука

    Подписка на Suno AI: тарифы, как купить из России и сколько стоит трек

    admin 20.06.2026
    20.06.2026

    Если вы открыли эту статью, то, скорее всего, уже знакомы с Suno AI: знаете, как работает нейросеть, и пробовали генерировать …

    0 VKOdnoklassnikiEmail
  • Генерация звука

    Как создать уникальный ИИ-голос в ElevenLabs — 5 готовых промтов

    admin 19.06.2026
    19.06.2026

    Чтобы ИИ-голос звучал по-настоящему живо, стоит отказаться от готовых пресетов и сгенерить свой. Это несложно: задаёте возраст, тембр, темп и …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов
  • Нейросеть будет «следить» за мусорными полигонами России
  • Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом
  • Казахстанские университеты вводят курсы по искусственному интеллекту в партнерстве с Google
  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

    31.07.2026
  • Нейросеть будет «следить» за мусорными полигонами России

    31.07.2026
  • Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом

    30.07.2026
  • Казахстанские университеты вводят курсы по искусственному интеллекту в партнерстве с Google

    30.07.2026
  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

    30.07.2026
  • Google Veo 2 дебютировал на Freepik: новая эра в создании видео с помощью ИИ

    29.07.2026

Рубрики

  • Генерация видео (94)
  • Генерация звука (14)
  • Генерация изображений (85)
  • Генерация текста (48)
  • Новости (40)
  • Обзор сервисов (36)

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но...

31.07.2026

Нейросеть будет «следить» за мусорными полигонами России

31.07.2026

Adobe запустила Firefly Video Model – генератор AI-видео...

30.07.2026

Казахстанские университеты вводят курсы по искусственному интеллекту в...

30.07.2026

Higgsfield AI: Революция в создании видео с искусственным...

30.07.2026

Обзоры

  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

    30.07.2026
  • Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    29.07.2026
  • Как оплатить Higgsfield AI и какие есть тарифы: подробный гайд

    28.07.2026

Выбор редакции

  • OpenAI выпустила отдельное приложение Codex для macOS

    19.06.2026
  • OpenAI добавила в Codex плагины для анализа данных, дизайна и других рабочих задач

    02.07.2026
  • OpenAI закрывает генератор видео Sora

    28.06.2026

Популярное

  • 1

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 2

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- All Right Reserved.


Наверх
AITopGuide
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов