Поиск.
Найдено: 0 моделей и 18 материалов
Материалы
Как задать system instruction в Gemini API и не смешать её с данными
Как задать system instruction в Gemini API и не смешать её с данными: конкретные шаги, тестовый пример, проверка результата и ошибки.
Как запустить Ollama как службу systemd в Linux и читать логи
Практический ответ на запрос «как запустить Ollama как службу Linux»: точные команды, реальные параметры Ollama, диагностика, ограничения и проверка результата.
Как перейти с generateContent на Gemini Interactions API и не сломать приложение
Практическая миграция Gemini API: соответствие contents и input, история через previous_interaction_id, store:false и поэтапная проверка.
Как хранить контекст диалога в OpenAI Responses API без дублирования сообщений
Практическая работа с previous_response_id и conversation: продолжение диалога, смена инструкций и контроль истории.
Как настроить Modelfile в Ollama: системный промпт, параметры и тест
Как создать собственную конфигурацию локальной модели в Ollama через Modelfile, собрать её и проверить одинаковыми запросами.
Как настроить Prompt Caching в Claude API и проверить cache_read_input_tokens
Как расставить cache_control в Claude API, сохранить стабильный префикс и подтвердить повторное чтение кеша по usage.
Как отправить первый запрос в GigaChat API через новый адрес api.giga.chat
Первый запрос к GigaChat через https://api.giga.chat: список моделей, chat/completions, Bearer-токен, разбор choices и usage.
Как проверить Prompt Caching в OpenAI API и найти промахи кеша
Практическая настройка Prompt Caching в OpenAI API: стабильный префикс, cached_tokens, контрольный тест и диагностика cache miss.
Как работает контекстный кэш DeepSeek API и как проверить cache hit
Практическое руководство: рабочий пример, структура ответа, ограничения, негативные тесты и проверка результата для запроса «как работает кэш DeepSeek API».
Как считать токены и расходы YandexGPT по полю usage
Контроль токенов YandexGPT: inputTextTokens, completionTokens, totalTokens, стоимость успешной задачи и поиск лишнего контекста.
Как считать токены до запроса Claude API и контролировать размер контекста
Как использовать Token Counting API Claude: собрать будущий запрос, оценить input tokens и решить, что сократить.
Как считать токены в Gemini API до запроса и после ответа
Как использовать countTokens и usage metadata в Gemini API, учитывать файлы и историю, а затем контролировать размер контекста.
Как сохранять контекст диалога в OpenAI Responses API без повторной отправки истории
Диалог через previous_response_id: хранение цепочки, инструкции, ветвление, контроль владельца и тест на смешивание пользователей.
Как вызвать модель через Hugging Face Inference Providers и закрепить провайдера
Как создать fine-grained токен, вызвать chat completion через InferenceClient, выбрать политику маршрутизации и проверить смену провайдера.
Как вызвать YandexGPT через REST API: IAM-токен, modelUri и разбор usage
Рабочий REST-запрос к YandexGPT: роль ai.languageModels.user, IAM-токен, modelUri каталога, completionOptions и проверка usage.
Как запустить локальный API в LM Studio и подключить приложение
Как загрузить модель в LM Studio, включить локальный сервер, отправить OpenAI-совместимый запрос и проверить ответ приложения.
Как подготовить данные с персональными данными для ИИ: минимизация и тестовый набор
Практический процесс подготовки данных для ИИ без лишних персональных сведений: цель, минимизация, замена и контроль.
Как считать токены Claude до отправки запроса и не превышать контекст
Использование Token Counting API Claude: предварительная оценка запроса, резерв под ответ и контроль сложных блоков.