Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как получить access token GigaChat API в 2026 году: OAuth, RqUID и scope
Актуальная авторизация GigaChat API: POST /api/v2/oauth, Basic-ключ, UUID в RqUID, три scope, срок токена 30 минут и безопасное обновление.
Как настроить Prompt Caching в Claude API и проверить cache_read_input_tokens
Как расставить cache_control в Claude API, сохранить стабильный префикс и подтвердить повторное чтение кеша по usage.
Как создать голосового ассистента через Gemini Live API и не раскрыть API-ключ
Архитектура Gemini Live API: WebSocket, PCM 16 кГц, аудио 24 кГц, ephemeral tokens, прерывание речи и проверка задержки.
Как посчитать токены в Gemini API до отправки большого запроса
Как посчитать токены в Gemini API до отправки большого запроса: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как проверить Prompt Caching в OpenAI API и найти промахи кеша
Практическая настройка Prompt Caching в OpenAI API: стабильный префикс, cached_tokens, контрольный тест и диагностика cache miss.
Как считать токены и расходы YandexGPT по полю usage
Контроль токенов YandexGPT: inputTextTokens, completionTokens, totalTokens, стоимость успешной задачи и поиск лишнего контекста.
Как считать токены до запроса Claude API и контролировать размер контекста
Как использовать Token Counting API Claude: собрать будущий запрос, оценить input tokens и решить, что сократить.
Как считать токены в Gemini API до запроса и после ответа
Как использовать countTokens и usage metadata в Gemini API, учитывать файлы и историю, а затем контролировать размер контекста.
Как включить Extended Thinking в Claude API и подобрать бюджет
Практическая настройка extended thinking в Claude Messages API: budget_tokens, max_tokens, тесты качества и контроль задержки.
Как автоматически писать и публиковать статьи на TNWS AI через ChatGPT
POST на https://ai.tnws.ru/api/admin/articles с заголовком x-admin-token: категории гайды, новости и обзоры, slug, SEO и готовый промпт.
Как работает Prompt Caching в OpenAI API и что реально экономит токены
Объясняем Prompt Caching: какой префикс повторять, куда ставить переменную часть, как измерять cached tokens и не путать кэш с памятью.
Как считать токены Claude до отправки запроса и не превышать контекст
Использование Token Counting API Claude: предварительная оценка запроса, резерв под ответ и контроль сложных блоков.
Что изменилось в GigaChat API в 2026 году: новый URL, токены и тарифы
Актуальные изменения GigaChat API на 12 сентября 2026 года: api.giga.chat, OAuth v2, токен 30 минут и новые условия подключения юрлиц.
Что лучше для API из России: GigaChat или YandexGPT
Практическое сравнение GigaChat API и YandexGPT API: авторизация, endpoints, функции, embeddings, биллинг и тест выбора.
Как отправить первый запрос в GigaChat API через новый адрес api.giga.chat
Первый запрос к GigaChat через https://api.giga.chat: список моделей, chat/completions, Bearer-токен, разбор choices и usage.
Как использовать embeddings Mistral для семантического поиска по документам
Практическое руководство: рабочий пример, структура ответа, ограничения, негативные тесты и проверка результата для запроса «как использовать embeddings Mistral».
Как подключить DeepSeek API через OpenAI SDK: base URL, ключ и первый запрос
Практическое руководство: рабочий пример, структура ответа, ограничения, негативные тесты и проверка результата для запроса «как подключить DeepSeek API».
Как сделать streaming-ответ YandexGPT и корректно собрать текст
Потоковая генерация YandexGPT: stream:true, чтение событий, накопление текста, status, отмена и обработка разрыва соединения.
Как создать эмбеддинги в Gemini API и проверить семантический поиск
Как вызвать embedContent в Gemini API, индексировать фрагменты, считать сходство и проверить поиск на реалистичном наборе вопросов.
Как уменьшить задержку OpenAI API: что измерять до смены модели
Оптимизация задержки OpenAI API: TTFT, полное время, streaming, длина вывода, параллельные запросы, кэш и корректный нагрузочный тест.