Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как настроить autoscaling Fireworks AI и обработать scale-to-zero
min/max replicas, окна масштабирования, load targets, код DEPLOYMENT_SCALING_UP и проверка холодного старта без потери запросов.
Как настроить tool calling в Fireworks AI и не выполнять неверные аргументы
JSON Schema инструмента, tool_choice, двухшаговый цикл вызова функции и обязательная серверная валидация аргументов на Fireworks AI.
Как подключить OpenAI SDK к Fireworks AI и проверить первый ответ
Практический запуск Fireworks через OpenAI Python SDK: правильный base_url, переменная ключа, полный идентификатор модели и контроль ответа.
Как настроить function calling в Cloudflare Workers AI безопасно
Traditional function calling в Workers AI: описание tools, JSON-аргументы, allowlist, schema validation, авторизация и двухшаговый вызов внешнего API.
Как получить строгий JSON по JSON Schema в Fireworks AI
Structured Outputs Fireworks: json_schema вместо json_object, required и additionalProperties, проверка finish_reason и Pydantic-валидация.
Как включить streaming в Fireworks AI API и собрать ответ без пропусков
Потоковый Chat Completions в Fireworks: stream=true, чтение delta.content, финальная сборка, UTF-8, таймаут и проверка результата.
Как настроить одиночный function calling в Together AI безопасно
Описание функции через JSON Schema, режимы tool_choice, разбор arguments, проверка allowlist и полный второй запрос с результатом инструмента.
Как настроить Real-Time STT AssemblyAI v3 и корректно закрывать сессию
Streaming SDK v3: Universal-3.5 Pro, sample_rate, TurnEvent, end_of_turn, terminate и контроль дубликатов в итоговой расшифровке.
Как настроить tool_choice в OpenAI API и не вызвать функцию случайно
Как настроить tool_choice в OpenAI API и не вызвать функцию случайно: применимость, настройка, пример, метрики и ошибки.
Как настроить webhook AssemblyAI для готовой расшифровки
webhook_url при submit, публичный HTTPS-приёмник, transcript id, повторное чтение результата, идемпотентность и защита от дублей.
Как проверить prompt caching в Fireworks AI по реальным метрикам
Стабильный префикс, x-session-affinity, cache isolation, заголовки cached prompt tokens и A/B-проверка TTFT без самообмана.
Как развернуть LoRA-модель в Fireworks AI: live merge или multi-LoRA
Выбор live merge и multi-LoRA, обязательный on-demand deployment, BF16 shape для addons, контроль base model и A/B-проверка адаптера.
Как создать on-demand deployment Fireworks AI и выбрать deployment shape
Выбор shape, создание через firectl, фиксация региона, проверка состояния и запрос по ресурсу deployment без выдуманных GPU-конфигураций.
Как запустить Batch API Fireworks AI и проверить каждую строку JSONL
Подготовка JSONL до 80 GiB, уникальные custom_id, body.messages, загрузка dataset, запуск job и сверка results/error файлов.
Как настроить проектный API-ключ OpenAI и разделить доступ приложений
Как создать отдельный проект OpenAI API, выпустить ключ, ограничить роли, настроить бюджеты и безопасную ротацию.
Как настроить webhook в OpenAI API и не потерять событие
Как настроить webhook в OpenAI API и не потерять событие: пошаговый разбор, готовый шаблон, пример и контроль ошибок.
Почему Fireworks AI возвращает 429 и как исправить причину
Разница 429 на serverless и dedicated/on-demand, чтение заголовков лимитов, управление concurrency, backoff с jitter и нагрузочный тест.
Как настроить Async Tool Calling в OpenAI API для долгих операций
Пошаговая схема Async Tool Calling в OpenAI API: постановка задачи, идентификатор операции, опрос статуса, идемпотентность и тест тайм-аута.
Как настроить Computer Use в OpenAI API: цикл скриншотов и безопасные действия
Практическая настройка Computer Use в OpenAI API: выполнение массива actions, скриншоты, изоляция браузера, подтверждения и тест prompt injection.
Как настроить Function Calling в OpenAI API: схема, выполнение и второй запрос
Как описать функцию для модели, проверить аргументы, выполнить код на сервере и вернуть результат в Responses API.