Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как улучшить распознавание терминов в AssemblyAI через prompt и keyterms
Universal-3.5 Pro: contextual prompt, keyterms_prompt, лимиты фраз, A/B-набор редких названий и измерение recall без выдуманных слов.
Как улучшить распознавание терминов в Deepgram через keyterm
Keyterm Prompting для Nova-3 и Flux: повтор параметров, URL-кодирование фраз, ограничения, регистр и честный тест recall на словаре терминов.
Как добавить подсказки для терминов в SpeechKit и проверить распознавание
Как добавить подсказки для терминов в SpeechKit и проверить распознавание: настройка API, пример, проверка качества и ошибки.
Как расшифровать аудио через AssemblyAI API и дождаться completed
Полный REST-цикл AssemblyAI: загрузка файла, POST /v2/transcript, polling статусов, разбор text, обработка error и проверка контрольной фразы.
Как разделить спикеров в AssemblyAI с speaker_labels
Диаризация AssemblyAI: utterances, speaker, start/end, speakers_expected, строгие границы min/max и проверка двухголосного эталона.
Как настроить Real-Time STT AssemblyAI v3 и корректно закрывать сессию
Streaming SDK v3: Universal-3.5 Pro, sample_rate, TurnEvent, end_of_turn, terminate и контроль дубликатов в итоговой расшифровке.
Как настроить webhook AssemblyAI для готовой расшифровки
webhook_url при submit, публичный HTTPS-приёмник, transcript id, повторное чтение результата, идемпотентность и защита от дублей.
Как определить язык аудио в AssemblyAI и проверить speech_model_used
Automatic Language Detection: language_detection, expected_languages, fallback, language_code и speech_model_used на русских и смешанных записях.
Как получить временный токен AssemblyAI для streaming в браузере
Серверная выдача temporary token, expires_in_seconds, max_session_duration_seconds и подключение клиента без раскрытия API-ключа.
Как расшифровать короткий WAV через AssemblyAI Sync STT без polling
Sync API для клипов до 120 секунд: Universal-3.5 Pro, WAV/PCM S16LE, локальные байты, language_codes и синхронный ответ.
Как сделать субтитры SRT и VTT через AssemblyAI
Экспорт completed transcript в SRT/VTT, chars_per_caption, проверка таймкодов и UTF-8, а также добавление спикеров через utterances.
Как включить Sentiment Analysis в AssemblyAI и проверить тональность фраз
sentiment_analysis=true: POSITIVE, NEUTRAL и NEGATIVE, confidence, временные интервалы, тестовые реплики и ограничения классификации.
Как настроить потоковое распознавание SpeechKit для голосового бота
Как настроить потоковое распознавание SpeechKit для голосового бота: настройка API, пример, проверка качества и ошибки.
Как выбрать синхронное или асинхронное распознавание SpeechKit
Как выбрать синхронное или асинхронное распознавание SpeechKit: настройка API, пример, проверка качества и ошибки.
Как извлечь текст из фото с нейросетью и проверить распознавание
Как распознать текст на скане, чеке или доске с помощью ИИ, где ошибки встречаются чаще всего и как быстро их отловить.
Как расшифровать длинный WAV через SpeechKit API v3
Как расшифровать длинный WAV через SpeechKit API v3: настройка API, пример, проверка качества и ошибки.
Как настроить голосовой режим ChatGPT: микрофон, приватность и полезные сценарии
Как начать разговор голосом в ChatGPT, улучшить распознавание и не отправить в сервис то, что не должно попасть в запись.
Как улучшить фото товара с ИИ и не изменить сам продукт
Как заменить фон, выровнять свет и убрать дефекты, сохранив форму, цвет, упаковку и важные детали товара.
Как снизить стоимость OpenRouter с вариантом :floor
Как работает :floor: сортировка endpoint по цене, допуск flex tier, отличие от provider.sort=price и расчет стоимости успешного результата.
Как настроить fallback между моделями в OpenRouter API
Готовая схема models в порядке приоритета: какие ошибки запускают переключение, как узнать итоговую модель и проверить качество резервного ответа.