Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как запустить Groq Batch API: подготовка JSONL и проверка результатов
Пакетная обработка Groq: custom_id, POST, url, body, загрузка JSONL, окно выполнения и сверка каждой строки без потери заявок.
Как запустить пакетную обработку через Mistral Batch API
Как запустить пакетную обработку через Mistral Batch API: рабочий сценарий, шаблон, пример и критерии проверки.
Как использовать Flex Processing в Groq и обработать ошибку 498
Настройка service_tier:flex для высоконагруженных задач: быстрый capacity_exceeded, jittered backoff, ограничение повторов и fallback на on-demand.
Как подключить Groq API к Python и проверить первый Chat Completion
Установка Groq SDK, безопасный API-ключ, первый запрос из Python и проверка content, finish_reason, model и usage на реальном ответе.
Как настроить reasoning_format в Groq API: parsed, raw или hidden
Выбор режима reasoning в Groq, различия GPT-OSS и Qwen, несовместимость параметров и проверка финального content без утечки рассуждений.
Как настроить Tool Use в Groq API и безопасно выполнить функцию
Полный цикл function calling в Groq: JSON Schema инструмента, проверка аргументов, выполнение на сервере и возврат tool result модели.
Как обработать пакет запросов через OpenAI Batch API и сверить результаты
Как подготовить JSONL для Batch API, связать ответы с исходными строками, обработать ошибки и проверить выборку.
Как отправить пакет запросов через Gemini Batch API и сопоставить ответы
Как создать batch job в Gemini API, выбрать inline или JSONL, отслеживать state и сопоставлять ошибки с исходными запросами.
Как подключить OpenAI SDK к Groq API и учесть несовместимые параметры
Миграция клиента OpenAI на Groq через base_url: рабочий пример и список параметров, которые дают 400 — logprobs, logit_bias и n не равное 1.
Как получить строгий JSON по JSON Schema через Groq API
Structured Outputs в Groq: response_format json_schema, strict:true, required, additionalProperties:false и локальная проверка бизнес-правил.
Как проверить Prompt Caching в Groq API и получить cache hit
Автоматический prompt caching Groq: стабильный общий префикс, cached_tokens, двухчасовое истечение, ограничения моделей и честный A/B-тест.
Как отправить пакет запросов через Claude Message Batches API
Как собрать batch-запросы Claude с custom_id, проверить статус, сопоставить результаты и повторить только ошибки.
Как включить streaming в Groq API и правильно собрать ответ из chunks
Потоковый Chat Completion через stream=True: обработка delta.content, пустых дельт, завершения потока и проверка собранного ответа.
Как запустить модель Replicate API из Python и сохранить результат
Практический запуск модели Replicate из Python: токен в окружении, replicate.run, проверка FileOutput и сохранение файла без выдуманных параметров.
Как использовать OpenAI Batch API для больших пачек запросов
Пошаговый гайд по Batch API: подготовка JSONL, уникальные идентификаторы, проверка статуса и сопоставление результатов без путаницы.
Как использовать Batch API xAI для большой пачки запросов Grok
Практическое руководство по запросу «как использовать Batch API Grok»: рабочий пример, реальные поля API, ограничения и проверка результата.
Почему Groq API возвращает 429 и как читать rate-limit headers
Диагностика RPM, RPD, TPM, TPD, ITPM и OTPM в Groq: retry-after, оставшиеся токены, очередь, jitter и защита от шторма повторов.
Как использовать Message Batches API Claude для большой пачки запросов
Пакетная обработка запросов Claude: подготовка custom_id, создание batch, контроль статуса и сопоставление результатов.
Как запустить фоновый запрос OpenAI API и дождаться результата без таймаута
Background mode Responses API: background:true, сохранение response ID, polling, терминальные статусы, отмена и защита от дублей.
Как запустить локальную нейросеть в Ollama: установка, модель и проверка API
Практический запуск локальной языковой модели через Ollama: установка, команда запуска, API-запрос и проверка приватности.