Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как настроить reasoning_format в Groq API: parsed, raw или hidden
Выбор режима reasoning в Groq, различия GPT-OSS и Qwen, несовместимость параметров и проверка финального content без утечки рассуждений.
Как настроить Tool Use в Groq API и безопасно выполнить функцию
Полный цикл function calling в Groq: JSON Schema инструмента, проверка аргументов, выполнение на сервере и возврат tool result модели.
Как подключить Groq API к Python и проверить первый Chat Completion
Установка Groq SDK, безопасный API-ключ, первый запрос из Python и проверка content, finish_reason, model и usage на реальном ответе.
Как подключить OpenAI SDK к Groq API и учесть несовместимые параметры
Миграция клиента OpenAI на Groq через base_url: рабочий пример и список параметров, которые дают 400 — logprobs, logit_bias и n не равное 1.
Как получить строгий JSON по JSON Schema через Groq API
Structured Outputs в Groq: response_format json_schema, strict:true, required, additionalProperties:false и локальная проверка бизнес-правил.
Как проверить Prompt Caching в Groq API и получить cache hit
Автоматический prompt caching Groq: стабильный общий префикс, cached_tokens, двухчасовое истечение, ограничения моделей и честный A/B-тест.
Как выбрать reasoning effort в OpenAI API и проверить эффект
Как выбрать reasoning effort в OpenAI API и проверить эффект: применимость, настройка, пример, метрики и ошибки.
Как запустить Groq Batch API: подготовка JSONL и проверка результатов
Пакетная обработка Groq: custom_id, POST, url, body, загрузка JSONL, окно выполнения и сверка каждой строки без потери заявок.
Как настроить fallback между моделями в OpenRouter API
Готовая схема models в порядке приоритета: какие ошибки запускают переключение, как узнать итоговую модель и проверить качество резервного ответа.
Как управлять reasoning tokens в OpenRouter и не переплачивать за рассуждение
Параметр reasoning, лимит усилий и токенов, поля ответа, учет стоимости и тест, показывающий когда длинное рассуждение не улучшает результат.
Как включить streaming в Groq API и правильно собрать ответ из chunks
Потоковый Chat Completion через stream=True: обработка delta.content, пустых дельт, завершения потока и проверка собранного ответа.
Как настроить safety settings в Gemini API и протестировать блокировки
Как настроить safety settings в Gemini API и протестировать блокировки: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как настроить streaming в Deepgram API без потери финальных реплик
WebSocket-транскрибация Deepgram: параметры кодека, interim_results, is_final, завершение потока, сбор финального текста и тест на обрыв.
Как настроить thinking в Gemini API и измерить пользу
Как настроить thinking в Gemini API и измерить пользу: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как настроить tool_choice в OpenAI API и не вызвать функцию случайно
Как настроить tool_choice в OpenAI API и не вызвать функцию случайно: применимость, настройка, пример, метрики и ошибки.
Почему Groq API возвращает 429 и как читать rate-limit headers
Диагностика RPM, RPD, TPM, TPD, ITPM и OTPM в Groq: retry-after, оставшиеся токены, очередь, jitter и защита от шторма повторов.
Как настроить function calling в Grok API и обработать несколько вызовов
Практическое руководство по запросу «как настроить function calling Grok API»: рабочий пример, реальные поля API, ограничения и проверка результата.
Как настроить проектный API-ключ OpenAI и разделить доступ приложений
Как создать отдельный проект OpenAI API, выпустить ключ, ограничить роли, настроить бюджеты и безопасную ротацию.
Как настроить tool use в Cohere API и обработать несколько функций
Практическое руководство по запросу «как настроить функции Cohere API»: реальные параметры Cohere API, рабочий код, ограничения и измеримая проверка результата.
Как настроить webhook в OpenAI API и не потерять событие
Как настроить webhook в OpenAI API и не потерять событие: пошаговый разбор, готовый шаблон, пример и контроль ошибок.