Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как создать on-demand deployment Fireworks AI и выбрать deployment shape
Выбор shape, создание через firectl, фиксация региона, проверка состояния и запрос по ресурсу deployment без выдуманных GPU-конфигураций.
Как настроить tool calling в Fireworks AI и не выполнять неверные аргументы
JSON Schema инструмента, tool_choice, двухшаговый цикл вызова функции и обязательная серверная валидация аргументов на Fireworks AI.
Как подключить OpenAI SDK к Fireworks AI и проверить первый ответ
Практический запуск Fireworks через OpenAI Python SDK: правильный base_url, переменная ключа, полный идентификатор модели и контроль ответа.
Как развернуть LoRA-модель в Fireworks AI: live merge или multi-LoRA
Выбор live merge и multi-LoRA, обязательный on-demand deployment, BF16 shape для addons, контроль base model и A/B-проверка адаптера.
Как настроить autoscaling Fireworks AI и обработать scale-to-zero
min/max replicas, окна масштабирования, load targets, код DEPLOYMENT_SCALING_UP и проверка холодного старта без потери запросов.
Как получить строгий JSON по JSON Schema в Fireworks AI
Structured Outputs Fireworks: json_schema вместо json_object, required и additionalProperties, проверка finish_reason и Pydantic-валидация.
Как включить streaming в Fireworks AI API и собрать ответ без пропусков
Потоковый Chat Completions в Fireworks: stream=true, чтение delta.content, финальная сборка, UTF-8, таймаут и проверка результата.
Как создать deployment в Replicate API и ограничить масштабирование
Создание deployment через интерфейс или POST /v1/deployments: model, version, hardware, min_instances, max_instances и проверка конфигурации.
Как проверить prompt caching в Fireworks AI по реальным метрикам
Стабильный префикс, x-session-affinity, cache isolation, заголовки cached prompt tokens и A/B-проверка TTFT без самообмана.
Как создать эмбеддинги Together AI и проверить порядок векторов
Один и несколько текстов через embeddings.create, multilingual E5, индексы response.data, единая модель для базы и запроса, контроль similarity.
Как запустить Batch API Fireworks AI и проверить каждую строку JSONL
Подготовка JSONL до 80 GiB, уникальные custom_id, body.messages, загрузка dataset, запуск job и сверка results/error файлов.
Почему Fireworks AI возвращает 429 и как исправить причину
Разница 429 на serverless и dedicated/on-demand, чтение заголовков лимитов, управление concurrency, backoff с jitter и нагрузочный тест.
Как разделить трафик между deployments Together AI без неверных процентов
Traffic weights, готовые replicas, update_mask=trafficSplit, нулевой вес, endpoint_not_configured и проверка фактического распределения.
Как настроить проектный API-ключ OpenAI и разделить доступ приложений
Как создать отдельный проект OpenAI API, выпустить ключ, ограничить роли, настроить бюджеты и безопасную ротацию.
Как создать incremental backup Weaviate и проверить восстановление
Полный и incremental backup Weaviate: backend, backup_id, include_collections, wait_for_completion, цепочка base backup, restore и контроль объектов.
Как выбрать Lucene или Faiss для Vector Search в OpenSearch
Сравнение Lucene HNSW, Faiss HNSW/IVF и deprecated NMSLIB по фильтрам, training, масштабу, памяти, indexing и recall.
Как сделать RAG на Cloudflare Workers AI и Vectorize без ошибки размерности
Создание Vectorize index с dimensions и cosine, AI и Vectorize bindings, генерация embeddings одной моделью, insert/query и проверка релевантности.
Как создать Preset в OpenRouter и вынести конфигурацию модели из кода
Preset как версионируемая конфигурация: модель, fallback, системный prompt, routing и параметры; вызов через @preset/slug и тест обновления.
Как пользоваться Google AI Studio: первый промпт, тестирование и безопасность
Практический старт в Google AI Studio: как создать ключ, проверить модель на задаче и не утечь с данными в тестовом проекте.
Как создать dense_vector mapping в Elasticsearch без ошибки размерности
Явный mapping dense_vector: dims, similarity, index_options, single-valued поле и отрицательный тест несовместимого embedding.