Гайд · TNWS AI
Как подключить OpenAI SDK к Groq API и учесть несовместимые параметры
Миграция клиента OpenAI на Groq через base_url: рабочий пример и список параметров, которые дают 400 — logprobs, logit_bias и n не равное 1.
Что решает этот гайд
Материал отвечает на запрос «как подключить OpenAI SDK к Groq API». Все параметры и ограничения сверены 12 сентября 2026 года с официальной документацией Groq. Задача статьи — получить воспроизводимый результат и показать, как доказать его корректность, а не ограничиться фразой «запрос сработал».
Применимость
Приложения на официальном OpenAI Python SDK, использующие совместимый Chat Completions интерфейс. Совместимость Groq широкая, но не полная.
Перед внедрением откройте страницы Models и Limits своей организации. Модельный каталог и персональные квоты меняются, поэтому статья не подменяет живую проверку. Зафиксируйте model id, версию SDK и контрольный вход в журнале теста.
Подтвержденные факты
- Нужен base_url
https://api.groq.com/openai/v1. - В api_key передается GROQ_API_KEY.
- logprobs, logit_bias, top_logprobs и messages[].name не поддерживаются и дают 400.
- Если передан n, он должен быть равен 1; temperature=0 преобразуется в 1e-8.
Groq использует OpenAI-подобную структуру Chat Completions: массив messages, выбранную model, choices, finish_reason и usage. При этом совместимость не означает равенство всех параметров. Проверяйте документацию конкретной возможности и не отправляйте неизвестные поля «на всякий случай».
Пошаговая настройка
- Сформулируйте машинный критерий: точная строка, валидная JSON Schema, допустимый tool call или определенный HTTP-код. Субъективное «ответ нормальный» не подходит.
- Создайте отдельный ключ для dev/stage/prod и храните его как
GROQ_API_KEYна backend. Не включайте Authorization в логи, браузерный bundle и репозиторий. - Скопируйте актуальный model id из Groq Console и проверьте поддержку нужной функции. Возможность Chat Completion не гарантирует structured output, reasoning или кэш.
- Выполните минимальный пример ниже. На первом прогоне отключите собственные retry и middleware, чтобы увидеть исходный HTTP-код и тело ошибки.
- Сравните ответ с условием: Существующий OpenAI-клиент получает groq-ok через Groq base_url; в запросе нет неподдерживаемых полей, n равно 1.
- Проведите отрицательный тест: неподдерживаемый параметр, невалидные аргументы, испорченная строка JSONL или искусственный 429/498. Ошибка должна обрабатываться явно.
- Затем добавьте ограниченные повторы, jitter, таймаут и метрики. Не повторяйте 400; исправляйте тело. Для 429 уважайте
retry-after, для Flex отдельно обрабатывайте 498.
Рабочий пример
from openai import OpenAI
import os
client=OpenAI(base_url="https://api.groq.com/openai/v1",api_key=os.environ["GROQ_API_KEY"])
r=client.chat.completions.create(model="llama-3.3-70b-versatile",
messages=[{"role":"user","content":"Верни строку groq-ok"}],
n=1, temperature=0.1)
assert "groq-ok" in r.choices[0].message.content.lower()
Значения в угловых скобках требуют замены на идентификаторы из актуальной документации. Пример намеренно не содержит настоящего ключа. Код бизнес-функций и хранилищ также должен иметь собственную авторизацию — модель не является системой контроля доступа.
Готовый промпт для проверки
Ты инженер приемки Groq API. Проверь приложенные request и response для сценария «как подключить OpenAI SDK к Groq API».
Верни таблицу: проверка | фактическое значение | PASS/FAIL | исправление.
Обязательно проверь HTTP-код, model, finish_reason, usage и условие результата.
Не восстанавливай отсутствующие поля и не считай HTTP 200 достаточным.
Перед передачей логов удалите ключ, персональные данные и лишний prompt. Решение о PASS принимает код по заданным правилам; языковая модель может только помочь найти несоответствия.
Контрольный вход и ожидаемый результат
Контрольный вход встроен в пример. Сохраните точные messages, model id и параметры. Сначала выполните пять одинаковых запросов, затем меняйте ровно один параметр. Это отделяет случайность генерации от ошибки конфигурации.
Ожидаемый результат: Существующий OpenAI-клиент получает groq-ok через Groq base_url; в запросе нет неподдерживаемых полей, n равно 1.
HTTP 200 подтверждает транспорт, но не формат и смысл. Проверяйте choices, finish_reason, непустой content, JSON Schema, аргументы инструментов или полноту batch-результатов. Отсутствующее поле нельзя молча заменять нулем: это скроет обрыв streaming или изменение SDK.
Критерии приемки
- base_url точный
- model доступна
- неподдерживаемые поля удалены
- n=1
- регрессии проверены
Сохраняйте request id, model, длительность, число входных и выходных токенов и итог локальной проверки. Для streaming отдельно измеряйте время первого токена и факт финального события. Для batch сверяйте множество custom_id, а не порядок строк.
Типичные ошибки и что не делать
- Оставлять OpenAI model id, которого нет в Groq.
- Передавать logprobs и ловить 400.
- Менять только ключ, но забывать base_url.
Не запускайте бесконечный retry. Четырехсотые ошибки чаще означают неверный запрос; повтор не исправит schema или model id. При временном отказе ограничьте число попыток, добавьте экспоненциальную задержку и случайный разброс, а после исчерпания верните задачу в очередь.
Не измеряйте качество одним красивым ответом. Соберите 20–50 обезличенных кейсов: короткий и длинный ввод, кириллица, пустое поле, конфликт инструкций, невалидный enum и превышение лимита. Проверяйте долю технических успехов и долю ответов, прошедших бизнес-валидацию, отдельно.
Проверка результата на реальных данных
Для классификации возьмите размеченные обращения, для JSON — набор граничных типов, для tools — разрешенные и запрещенные аргументы. У каждого примера должно быть машинное условие. После смены модели, SDK или system prompt прогоните весь набор заново.
Полезная итоговая метрика — стоимость и задержка одного валидного результата. Она учитывает отбраковку, retry и ошибки формата. Средняя скорость успешного HTTP-запроса не показывает, сколько ответов реально пригодны пользователю.
FAQ
Достаточно ли одного успешного запроса?
Нет. Нужна серия и минимум один отрицательный тест.
Где брать точные model id и лимиты?
В актуальных разделах Models и Limits Groq Console для вашей организации.
Можно ли хранить GROQ_API_KEY в браузере?
Нет. Постоянный ключ должен оставаться на backend или в менеджере секретов.
Что логировать?
Request id, model, HTTP-код, finish_reason, usage, длительность и результат валидации — без ключа и лишних персональных данных.
Официальный источник
Частые вопросы
Достаточно ли HTTP 200?
Нет, проверьте finish_reason, usage и бизнес-условие.
Где брать model id?
В актуальном разделе Models Groq Console.
Можно ли хранить ключ в браузере?
Нет, постоянный ключ хранится на backend.
Нужен ли негативный тест?
Да, он доказывает безопасную обработку отказа.
Читайте также
Как использовать Flex Processing в Groq и обработать ошибку 498
Настройка service_tier:flex для высоконагруженных задач: быстрый capacity_exceeded, jittered backoff, ограничение повторов и fallback на on-demand.
Как настроить reasoning_format в Groq API: parsed, raw или hidden
Выбор режима reasoning в Groq, различия GPT-OSS и Qwen, несовместимость параметров и проверка финального content без утечки рассуждений.
Как настроить Tool Use в Groq API и безопасно выполнить функцию
Полный цикл function calling в Groq: JSON Schema инструмента, проверка аргументов, выполнение на сервере и возврат tool result модели.
Комментарии
Пока тихо. Скажите первое слово