Перейти до змісту
Content Creator Tools

Транскрибуй аудіо чи відео

Перетягни файл, щоб отримати текст, субтитри або синхронізовану лірику. Розпізнавання працює у твоєму браузері, файл нікуди не завантажується.

Перший запуск завантажує модель розпізнавання (приблизно 250–600 МБ), далі браузер тримає її в кеші.

Як це працює

Анімація: відеофайл кидають у зону, звук розпізнається слово за словом із таймкодами, потім зберігається як SRT.

  1. 1

    Додай файл

    Будь-яке аудіо чи відео: твоя пісня, голосова нотатка, рілс.

  2. 2

    Обери мову

    Вкажи мову мовлення чи вокалу. Так розпізнавання помітно точніше.

  3. 3

    Отримай текст або субтитри

    Скопіюй текст із таймінгами або збережи субтитри SRT чи AE Subs для After Effects.

Часті запитання

Мій файл кудись завантажується?

Ні. Файл декодується й розпізнається всередині браузера. З Hugging Face завантажуються лише ваги моделі.

Наскільки точно розпізнається музика?

Спів на фоні гучних інструментів розпізнати складніше, ніж мовлення. Для кращого результату обери правильну мову.

Чому перший запуск повільний?

Браузер один раз завантажує модель і кешує її. З WebGPU розпізнавання в кілька разів швидше, ніж на CPU.

У які формати можна експортувати?

Субтитри SRT і AE Subs: файл із таймінгами рядків, слів і літер для нашого плагіна After Effects. Кнопка копіювання дає текст із таймкодами рядків.

Відгук або ідея

Що це