Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как создать Ephemeral Token для Gemini Live API и не раскрыть основной ключ
Настройка временных токенов Gemini Live API: auth_tokens.create, uses, expire_time, new_session_expire_time, constraints и безопасная выдача клиенту.
Как создать голосового ассистента через Gemini Live API и не раскрыть API-ключ
Архитектура Gemini Live API: WebSocket, PCM 16 кГц, аудио 24 кГц, ephemeral tokens, прерывание речи и проверка задержки.
Как получить access token GigaChat API в 2026 году: OAuth, RqUID и scope
Актуальная авторизация GigaChat API: POST /api/v2/oauth, Basic-ключ, UUID в RqUID, три scope, срок токена 30 минут и безопасное обновление.
Как настроить Prompt Caching в Claude API и проверить cache_read_input_tokens
Как расставить cache_control в Claude API, сохранить стабильный префикс и подтвердить повторное чтение кеша по usage.
Как настроить голосовой диалог через Gemini Live API и безопасно прерывать ответ
Архитектура Gemini Live API: WebSocket, PCM-аудио, ephemeral tokens, barge-in, транскрипты и проверка задержек.
Как посчитать токены в Gemini API до отправки большого запроса
Как посчитать токены в Gemini API до отправки большого запроса: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как посчитать токены локальной модели в LM Studio до запроса
Как посчитать токены локальной модели в LM Studio до запроса: точная настройка, пример, критерии проверки и типичные ошибки.
Как подключить Web Fetch в Claude API для чтения страниц и PDF
Гайд по Claude Web Fetch: allowed_domains, max_uses, max_content_tokens, citations, cache bypass, dynamic filtering и проверка источников.
Как проверить Prompt Caching в OpenAI API и найти промахи кеша
Практическая настройка Prompt Caching в OpenAI API: стабильный префикс, cached_tokens, контрольный тест и диагностика cache miss.
Как распознать речь через Hugging Face Inference Providers API
Практический ASR-гайд: выбор warmed-модели, HF_TOKEN, аудиобайты, return_timestamps, проверка транскрипции и обработка ошибок.
Как считать токены и расходы YandexGPT по полю usage
Контроль токенов YandexGPT: inputTextTokens, completionTokens, totalTokens, стоимость успешной задачи и поиск лишнего контекста.
Как считать токены до запроса Claude API и контролировать размер контекста
Как использовать Token Counting API Claude: собрать будущий запрос, оценить input tokens и решить, что сократить.
Как считать токены в Gemini API до запроса и после ответа
Как использовать countTokens и usage metadata в Gemini API, учитывать файлы и историю, а затем контролировать размер контекста.
Как считать токены и запросы через Usage в OpenAI Agents SDK
Как получить requests, input_tokens, output_tokens и request_usage_entries в OpenAI Agents SDK, проверить многошаговый run и подготовить корректный журнал потребления.
Как включить Extended Thinking в Claude API и подобрать бюджет
Практическая настройка extended thinking в Claude Messages API: budget_tokens, max_tokens, тесты качества и контроль задержки.
Как автоматически писать и публиковать статьи на TNWS AI через ChatGPT
POST на https://ai.tnws.ru/api/admin/articles с заголовком x-admin-token: категории гайды, новости и обзоры, slug, SEO и готовый промпт.
Как работает Prompt Caching в OpenAI API и что реально экономит токены
Объясняем Prompt Caching: какой префикс повторять, куда ставить переменную часть, как измерять cached tokens и не путать кэш с памятью.
Как считать токены Claude до отправки запроса и не превышать контекст
Использование Token Counting API Claude: предварительная оценка запроса, резерв под ответ и контроль сложных блоков.
Что изменилось в GigaChat API в 2026 году: новый URL, токены и тарифы
Актуальные изменения GigaChat API на 12 сентября 2026 года: api.giga.chat, OAuth v2, токен 30 минут и новые условия подключения юрлиц.
Что лучше в Ollama: Q4, Q5 или Q8-квантизация модели
Практический ответ на запрос «что лучше Q4 Q5 или Q8 Ollama»: точные команды, реальные параметры Ollama, диагностика, ограничения и проверка результата.