Справочник
Источники
YouTube, TikTok, ваши файлы и прямые ссылки: принимаемые адреса, что делает каждый режим и ограничения.
Обновлено
Какой бы ни был источник, вы получаете один и тот же объект транскрипта: текст, сегменты с таймингами и тайминги по словам, если транскрипт создала ИИ-транскрипция. Ограничения для всех источников: 2 часа и 250 МБ.
Источники#
| Источник | Принимаемые ссылки | captions_only | auto / transcribe |
|---|---|---|---|
| YouTube | youtube.com/watch?v=…, youtu.be/…, /shorts/…, /live/… | Субтитры автора или автоматические, 1 кредит | Платные тарифы |
| TikTok | tiktok.com/@user/video/…, ссылки для общего доступа vm.tiktok.com/… | Субтитры автора, 1 кредит | Платные тарифы |
| Ваш файл | mp3, wav, m4a, ogg, aac, mp4, webm через POST /v1/uploads | Недоступно | Платные тарифы |
| Прямая ссылка | Любой публичный URL по https, который отдаёт аудио- или видеофайл | Недоступно | Платные тарифы |
GET /v1/capabilities с вашим ключом возвращает эту таблицу для вашего тарифа, поэтому клиент может показывать только то, что будет работать.
Субтитры#
- Только публичные видео. Приватные видео, видео только для участников и видео с возрастным ограничением завершаются ошибкой с кодом
SOURCE_*. - У YouTube два вида субтитров: загруженные автором и автоматические.
caption_preferenceвыбирает нужный. По умолчанию берутся субтитры автора, если они есть. caption_languagesзапрашивает определённые дорожки, например["es", "en"].POST /v1/language-discoveriesпоказывает, какие дорожки есть у видео YouTube.- Тайминг задаётся для каждой реплики субтитров (
timing_granularity: "segment").
ИИ-транскрипция#
- Распознаёт речь в аудио, работает с субтитрами и без них. Определяет язык или принимает подсказку в
language. - Возвращает тайминги и уверенность по каждому слову (
timing_granularity: "word"). - Занимает примерно четверть длительности медиафайла. Используйте
?wait=25или вебхук, а не частый опрос. - 2 кредита за каждую начатую минуту, минимум 1 минута. Ограничьте задачу параметром
max_credits.