Поиск.
Найдено: 0 моделей и 8 материалов
Материалы
Как использовать context caching в Gemini API для повторяющегося контекста
Как использовать context caching в Gemini API для повторяющегося контекста: пошаговый разбор, готовый шаблон, пример и контроль ошибок.
Как настроить context caching в Gemini API и проверить экономию повторных запросов
Как создать кеш большого контекста Gemini, переиспользовать его, контролировать TTL и сверять usage без выдуманных процентов.
Как использовать URL Context в Gemini API для разбора страницы
Как использовать URL Context в Gemini API для разбора страницы: пошаговый разбор, готовый шаблон, пример и контроль ошибок.
Как работает Prompt Caching в OpenAI API и что реально экономит токены
Объясняем Prompt Caching: какой префикс повторять, куда ставить переменную часть, как измерять cached tokens и не путать кэш с памятью.
Как анализировать веб-страницы через Gemini URL Context с цитатами
Как передать Gemini список URL, извлечь данные, получить url_citation и проверить статус загрузки каждой страницы.
Как работает prompt caching в Claude API и когда он полезен
Разбираем кэширование промптов Claude: что размещать в стабильном префиксе, как проверять токены кэша и чего не ожидать.
Как анализировать PDF с таблицами и графиками через Claude API
Как передать PDF в Claude API, задать вопросы по страницам, получить цитаты и проверить числа из таблиц и графиков.
Что лучше для OpenAI API: сокращать токены или использовать меньшую модель
Сравнение способов снизить расходы OpenAI API: входной контекст, длина ответа, кэширование, smaller model и проверка качества на eval.