Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Почему pgvector не использует индекс: проверяем ORDER BY, LIMIT и EXPLAIN
Диагностика Seq Scan вместо HNSW/IVFFlat: форма ORDER BY, operator class, LIMIT, размер таблицы и безопасный тест planner.
Как уменьшить индекс pgvector через halfvec и binary quantization
Сравнение vector, halfvec и bit-индексов, expression index, Hamming candidates, reranking исходными embeddings и проверка recall.
Как включить iterative scan в pgvector: strict_order и relaxed_order
Настройка pgvector 0.8+ для фильтрованного ANN: strict/relaxed ordering, materialized CTE и ограничения сканирования.
Почему pgvector с фильтром возвращает меньше строк и как это исправить
Post-filtering ANN, hnsw.ef_search, iterative scans, B-tree, partial index и partitioning для tenant/category filters.
Почему dense_vector нет в _source Elasticsearch и как получить vector
Поведение exclude_source_vectors, fields, docvalue_fields, binary format, rehydration и сохранение исходной точности для аудита.
Почему Redis Search не находит документ с vector: диагностика через FT.INFO
Проверка prefix, key type, schema, DIM, indexing progress, Index Errors, last error key и canary KNN без опасной переиндексации.
Почему Together AI возвращает 429 и как читать x-ratelimit-reset
Динамические serverless limits, сглаживание RPM, x-ratelimit-reset, backoff с jitter и отличие от GPU quota dedicated deployment.
Почему Groq API возвращает 429 и как читать rate-limit headers
Диагностика RPM, RPD, TPM, TPD, ITPM и OTPM в Groq: retry-after, оставшиеся токены, очередь, jitter и защита от шторма повторов.
Почему Ollama использует процессор вместо видеокарты
Практический ответ на запрос «почему Ollama работает на CPU а не GPU»: точные команды, реальные параметры Ollama, диагностика, ограничения и проверка результата.
Как настроить HNSW в pgvector и подобрать ef_search по Recall@10
Создание HNSW-индекса, m, ef_construction, ef_search, SET LOCAL и честное сравнение ANN с exact search.
Как настроить IVFFlat в pgvector: lists, probes и порядок загрузки
Расчёт стартовых lists и probes, создание индекса после загрузки данных, exact baseline и диагностика неполной выдачи.
Как сделать hybrid search в pgvector: PostgreSQL FTS и RRF
Две независимые выдачи pgvector и tsvector, Reciprocal Rank Fusion, tenant filter, конкретный SQL и оценка nDCG@10.
Что такое контекстное окно нейросети простыми словами и почему ответы «забываются»
Объясняем, что модель учитывает в диалоге, почему длинные чаты теряют детали и как сохранить важный контекст без лишней воды.
Почему search_query и search_document в Cohere нельзя путать
Практическое руководство по запросу «почему Cohere embeddings плохо ищут»: реальные параметры Cohere API, рабочий код, ограничения и измеримая проверка результата.
Почему нет доступа к gated-модели Hugging Face
Практический ответ на запрос «почему Hugging Face пишет gated model»: реальные настройки Hugging Face, рабочий код, ограничения и проверка результата.
Как установить pgvector в PostgreSQL и проверить расширение
Установка pgvector 0.8.6 для PostgreSQL 13+, CREATE EXTENSION, проверка версии и воспроизводимый smoke-тест без догадок.
Почему stop sequence не работает в OpenAI API и чем её заменить
Почему stop sequence не работает в OpenAI API и чем её заменить: применимость, настройка, пример, метрики и ошибки.
Почему Cloudflare Workers AI возвращает 429 и как проверить лимит
Актуальные rate limits Workers AI по task type и моделям, учёт локального inference, измерение RPM, backoff с jitter и корректная диагностика 429.
Как выбрать метрику pgvector: cosine, L2 или inner product
Операторы <=>, <-> и <#>, преобразование distance в similarity, нормализованные embeddings и точный baseline для RAG.
Как проверить prompt caching в OpenRouter и не потерять cache hit
Как устроить повторяемый префикс, использовать session_id, читать cached_tokens и cache_write_tokens и не ломать липкую маршрутизацию provider.order.