Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как считать токены и запросы через Usage в OpenAI Agents SDK
Как получить requests, input_tokens, output_tokens и request_usage_entries в OpenAI Agents SDK, проверить многошаговый run и подготовить корректный журнал потребления.
Как считать токены и расходы YandexGPT по полю usage
Контроль токенов YandexGPT: inputTextTokens, completionTokens, totalTokens, стоимость успешной задачи и поиск лишнего контекста.
Как вызвать YandexGPT через REST API: IAM-токен, modelUri и разбор usage
Рабочий REST-запрос к YandexGPT: роль ai.languageModels.user, IAM-токен, modelUri каталога, completionOptions и проверка usage.
Как настроить context caching в Gemini API и проверить экономию повторных запросов
Как создать кеш большого контекста Gemini, переиспользовать его, контролировать TTL и сверять usage без выдуманных процентов.
Как настроить Prompt Caching в Claude API и проверить cache_read_input_tokens
Как расставить cache_control в Claude API, сохранить стабильный префикс и подтвердить повторное чтение кеша по usage.
Как отправить первый запрос в GigaChat API через новый адрес api.giga.chat
Первый запрос к GigaChat через https://api.giga.chat: список моделей, chat/completions, Bearer-токен, разбор choices и usage.
Как считать токены в Gemini API до запроса и после ответа
Как использовать countTokens и usage metadata в Gemini API, учитывать файлы и историю, а затем контролировать размер контекста.
Что нового в Hugging Face Inference Providers и router API
Практический ответ на запрос «что нового в Hugging Face Inference Providers»: реальные настройки Hugging Face, рабочий код, ограничения и проверка результата.
Что нового проверять в ElevenLabs API перед обновлением интеграции
Практический разбор запроса «что нового в ElevenLabs API 2026»: реальные поля ElevenLabs API, рабочий пример, ограничения, диагностика и проверка аудио.
Что нового в Grok 4.6 API: контекст, reasoning, инструменты и цена
Практическое руководство по запросу «что нового в Grok 4.6 API»: рабочий пример, реальные поля API, ограничения и проверка результата.
Как анализировать PDF через OpenAI File Inputs и проверять таблицы и схемы
Как передать PDF в Responses API через input_file, выбрать detail, сослаться на страницы и проверить числа по оригиналу.
Как добавить Google Maps grounding в Gemini API для поиска мест
Как добавить Google Maps grounding в Gemini API для поиска мест: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как добавить Web Search в Claude API и ограничить источники
Как подключить web_search tool Claude, задать max_uses и домены, собрать цитаты и проверить дату каждого найденного факта.
Как фильтровать поиск по метаданным в OpenAI vector store
Как фильтровать поиск по метаданным в OpenAI vector store: применимость, настройка, пример, метрики и ошибки.
Как генерировать изображения через OpenAI API и проверять результат
Как выбрать Image API или Responses API, составить технический промпт, сохранить изображение и проверить размеры, текст и ограничения.
Как использовать Batch API xAI для большой пачки запросов Grok
Практическое руководство по запросу «как использовать Batch API Grok»: рабочий пример, реальные поля API, ограничения и проверка результата.
Как использовать logprobs в OpenAI API для контроля классификации
Как использовать logprobs в OpenAI API для контроля классификации: применимость, настройка, пример, метрики и ошибки.
Как вызвать Gemini API через OpenAI SDK и проверить совместимость
Практическая миграция на Gemini через OpenAI SDK: base_url, GEMINI_API_KEY, chat.completions, smoke-тест, обработка несовместимых параметров и откат.
Как использовать Responses API Hugging Face Inference Providers
Практический ответ на запрос «как использовать Hugging Face Responses API»: реальные настройки Hugging Face, рабочий код, ограничения и проверка результата.
Как использовать Ollama Web Search API и собирать ответы с источниками
Как вызвать ollama.web_search или /api/web_search, отфильтровать результаты, загрузить страницы и проверить цитаты перед ответом.