Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как считать токены и расходы YandexGPT по полю usage
Контроль токенов YandexGPT: inputTextTokens, completionTokens, totalTokens, стоимость успешной задачи и поиск лишнего контекста.
Как вызвать YandexGPT через REST API: IAM-токен, modelUri и разбор usage
Рабочий REST-запрос к YandexGPT: роль ai.languageModels.user, IAM-токен, modelUri каталога, completionOptions и проверка usage.
Как настроить context caching в Gemini API и проверить экономию повторных запросов
Как создать кеш большого контекста Gemini, переиспользовать его, контролировать TTL и сверять usage без выдуманных процентов.
Как настроить Prompt Caching в Claude API и проверить cache_read_input_tokens
Как расставить cache_control в Claude API, сохранить стабильный префикс и подтвердить повторное чтение кеша по usage.
Как отправить первый запрос в GigaChat API через новый адрес api.giga.chat
Первый запрос к GigaChat через https://api.giga.chat: список моделей, chat/completions, Bearer-токен, разбор choices и usage.
Как считать токены в Gemini API до запроса и после ответа
Как использовать countTokens и usage metadata в Gemini API, учитывать файлы и историю, а затем контролировать размер контекста.
Что нового в Grok 4.6 API: контекст, reasoning, инструменты и цена
Практическое руководство по запросу «что нового в Grok 4.6 API»: рабочий пример, реальные поля API, ограничения и проверка результата.
Как добавить Google Maps grounding в Gemini API для поиска мест
Как добавить Google Maps grounding в Gemini API для поиска мест: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как фильтровать поиск по метаданным в OpenAI vector store
Как фильтровать поиск по метаданным в OpenAI vector store: применимость, настройка, пример, метрики и ошибки.
Как генерировать изображения через OpenAI API и проверять результат
Как выбрать Image API или Responses API, составить технический промпт, сохранить изображение и проверить размеры, текст и ограничения.
Как использовать Batch API xAI для большой пачки запросов Grok
Практическое руководство по запросу «как использовать Batch API Grok»: рабочий пример, реальные поля API, ограничения и проверка результата.
Как использовать logprobs в OpenAI API для контроля классификации
Как использовать logprobs в OpenAI API для контроля классификации: применимость, настройка, пример, метрики и ошибки.
Как настроить function calling в Grok API и обработать несколько вызовов
Практическое руководство по запросу «как настроить function calling Grok API»: рабочий пример, реальные поля API, ограничения и проверка результата.
Как настроить safety settings в Gemini API и протестировать блокировки
Как настроить safety settings в Gemini API и протестировать блокировки: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как настроить streaming в OpenAI Responses API и правильно собрать ответ
Потоковая выдача OpenAI: stream:true, типы SSE-событий, text delta, завершение, tool calls и восстановление после обрыва.
Как настроить thinking в Gemini API и измерить пользу
Как настроить thinking в Gemini API и измерить пользу: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как настроить tool_choice в OpenAI API и не вызвать функцию случайно
Как настроить tool_choice в OpenAI API и не вызвать функцию случайно: применимость, настройка, пример, метрики и ошибки.
Как ограничить поиск Perplexity API официальными сайтами
Практическое руководство по запросу «как настроить фильтр сайтов Perplexity API»: рабочий пример, реальные поля API, ограничения и проверка результата.
Как отключить parallel tool calls в OpenAI API для последовательных действий
Как отключить parallel tool calls в OpenAI API для последовательных действий: применимость, настройка, пример, метрики и ошибки.
Как отправить пакет запросов через Claude Message Batches API
Как собрать batch-запросы Claude с custom_id, проверить статус, сопоставить результаты и повторить только ошибки.