Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как определить язык аудио в AssemblyAI и проверить speech_model_used
Automatic Language Detection: language_detection, expected_languages, fallback, language_code и speech_model_used на русских и смешанных записях.
Как определить язык аудио в Deepgram и проверить language_confidence
detect_language=true для предзаписанного и streaming-аудио: detected_language, confidence, многоканальные записи и отличие от multilingual.
Как расшифровать аудио через AssemblyAI API и дождаться completed
Полный REST-цикл AssemblyAI: загрузка файла, POST /v2/transcript, polling статусов, разбор text, обработка error и проверка контрольной фразы.
Как получить summary аудио в Deepgram и не ошибиться с языком
Summarization v2 в Deepgram: английский язык, поля result и short, обработка warnings при detect_language и проверка краткого содержания по фактам.
Как разделить спикеров в AssemblyAI с speaker_labels
Диаризация AssemblyAI: utterances, speaker, start/end, speakers_expected, строгие границы min/max и проверка двухголосного эталона.
Как настроить Real-Time STT AssemblyAI v3 и корректно закрывать сессию
Streaming SDK v3: Universal-3.5 Pro, sample_rate, TurnEvent, end_of_turn, terminate и контроль дубликатов в итоговой расшифровке.
Как настроить webhook AssemblyAI для готовой расшифровки
webhook_url при submit, публичный HTTPS-приёмник, transcript id, повторное чтение результата, идемпотентность и защита от дублей.
Как получить временный токен AssemblyAI для streaming в браузере
Серверная выдача temporary token, expires_in_seconds, max_session_duration_seconds и подключение клиента без раскрытия API-ключа.
Как расшифровать короткий WAV через AssemblyAI Sync STT без polling
Sync API для клипов до 120 секунд: Universal-3.5 Pro, WAV/PCM S16LE, локальные байты, language_codes и синхронный ответ.
Как сделать субтитры SRT и VTT через AssemblyAI
Экспорт completed transcript в SRT/VTT, chars_per_caption, проверка таймкодов и UTF-8, а также добавление спикеров через utterances.
Как улучшить распознавание терминов в AssemblyAI через prompt и keyterms
Universal-3.5 Pro: contextual prompt, keyterms_prompt, лимиты фраз, A/B-набор редких названий и измерение recall без выдуманных слов.
Как включить Sentiment Analysis в AssemblyAI и проверить тональность фраз
sentiment_analysis=true: POSITIVE, NEUTRAL и NEGATIVE, confidence, временные интервалы, тестовые реплики и ограничения классификации.
Как расшифровать аудио через Deepgram API и проверить точность результата
Практический запрос к /v1/listen для локального WAV и файла по URL: Nova-3, smart_format, структура JSON, confidence и критерии приёмки.
Как расшифровать аудио через OpenAI API: файл, язык и проверка таймкодов
Пошаговая транскрибация аудио через OpenAI API: подготовка записи, формат ответа, имена, таймкоды и защита конфиденциальной речи.
Как подготовить аудиобриф в NotebookLM: источники, фокус и контроль фактов
Практический гайд по созданию аудиобрифа из документов в NotebookLM с настройкой фокуса и проверкой неточностей.
Как расшифровать аудио через OpenAI API и проверить имена, числа и таймкоды
Пошаговая транскрибация аудиофайла через OpenAI API: подготовка записи, audio.transcriptions.create, словарь терминов и контроль ошибок.
Как озвучить текст через Deepgram TTS и сохранить корректный аудиофайл
POST /v1/speak, Aura-2, MP3 или WAV, Content-Type, потоковый ответ, fail-with-body и техническая проверка файла через ffprobe.
Как расшифровать русское аудио через Voxtral API
Как расшифровать русское аудио через Voxtral API: рабочий сценарий, шаблон, пример и критерии проверки.
Как определить last_agent после handoff в OpenAI Agents SDK
Проверяем, какой агент сформировал финальный результат после handoff, сохраняем стабильное имя и не определяем маршрут по тексту ответа.
Как расшифровать аудио с нейросетью: точный текст, таймкоды и защита данных
Как превратить интервью, созвон или голосовую заметку в читаемый текст: подготовка записи, проверка имён и удобный формат результата.