Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как расшифровать короткий WAV через AssemblyAI Sync STT без polling
Sync API для клипов до 120 секунд: Universal-3.5 Pro, WAV/PCM S16LE, локальные байты, language_codes и синхронный ответ.
Как расшифровать аудио через AssemblyAI API и дождаться completed
Полный REST-цикл AssemblyAI: загрузка файла, POST /v2/transcript, polling статусов, разбор text, обработка error и проверка контрольной фразы.
Как настроить Real-Time STT AssemblyAI v3 и корректно закрывать сессию
Streaming SDK v3: Universal-3.5 Pro, sample_rate, TurnEvent, end_of_turn, terminate и контроль дубликатов в итоговой расшифровке.
Как расшифровать длинный WAV через SpeechKit API v3
Как расшифровать длинный WAV через SpeechKit API v3: настройка API, пример, проверка качества и ошибки.
Как разделить спикеров в AssemblyAI с speaker_labels
Диаризация AssemblyAI: utterances, speaker, start/end, speakers_expected, строгие границы min/max и проверка двухголосного эталона.
Как получить временный токен AssemblyAI для streaming в браузере
Серверная выдача temporary token, expires_in_seconds, max_session_duration_seconds и подключение клиента без раскрытия API-ключа.
Как настроить webhook AssemblyAI для готовой расшифровки
webhook_url при submit, публичный HTTPS-приёмник, transcript id, повторное чтение результата, идемпотентность и защита от дублей.
Как определить язык аудио в AssemblyAI и проверить speech_model_used
Automatic Language Detection: language_detection, expected_languages, fallback, language_code и speech_model_used на русских и смешанных записях.
Как расшифровать аудио через Deepgram API и проверить точность результата
Практический запрос к /v1/listen для локального WAV и файла по URL: Nova-3, smart_format, структура JSON, confidence и критерии приёмки.
Как сделать субтитры SRT и VTT через AssemblyAI
Экспорт completed transcript в SRT/VTT, chars_per_caption, проверка таймкодов и UTF-8, а также добавление спикеров через utterances.
Как улучшить распознавание терминов в AssemblyAI через prompt и keyterms
Universal-3.5 Pro: contextual prompt, keyterms_prompt, лимиты фраз, A/B-набор редких названий и измерение recall без выдуманных слов.
Как включить Sentiment Analysis в AssemblyAI и проверить тональность фраз
sentiment_analysis=true: POSITIVE, NEUTRAL и NEGATIVE, confidence, временные интервалы, тестовые реплики и ограничения классификации.
Как настроить Async Tool Calling в OpenAI API для долгих операций
Пошаговая схема Async Tool Calling в OpenAI API: постановка задачи, идентификатор операции, опрос статуса, идемпотентность и тест тайм-аута.
Как озвучить русский текст через SpeechKit API v3 и сохранить WAV
Как озвучить русский текст через SpeechKit API v3 и сохранить WAV: настройка API, пример, проверка качества и ошибки.
Как расшифровать русское аудио через Voxtral API
Как расшифровать русское аудио через Voxtral API: рабочий сценарий, шаблон, пример и критерии проверки.
Как дождаться результата prediction в Replicate: sync, async и polling
Когда использовать Prefer: wait, а когда polling или webhook в Replicate API: статусы prediction, пример цикла ожидания, таймаут и критерии завершения.
Как озвучить русский текст через Gemini TTS и сохранить WAV
Настройка Gemini TTS через Interactions API: response_format audio, speech_config, voice, Base64, параметры WAV и проверка произношения.
Как выбрать синхронное или асинхронное распознавание SpeechKit
Как выбрать синхронное или асинхронное распознавание SpeechKit: настройка API, пример, проверка качества и ошибки.
Как добавить подсказки для терминов в SpeechKit и проверить распознавание
Как добавить подсказки для терминов в SpeechKit и проверить распознавание: настройка API, пример, проверка качества и ошибки.
Как настроить потоковое распознавание SpeechKit для голосового бота
Как настроить потоковое распознавание SpeechKit для голосового бота: настройка API, пример, проверка качества и ошибки.