Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Почему dense_vector нет в _source Elasticsearch и как получить vector
Поведение exclude_source_vectors, fields, docvalue_fields, binary format, rehydration и сохранение исходной точности для аудита.
Как включить int8, int4 или BBQ-квантование dense_vector в Elasticsearch
Сравнение int8_hnsw, int4_hnsw и bbq_hnsw, ограничения dimensions, oversampling, rescoring и честная оценка памяти.
Как создать dense_vector mapping в Elasticsearch без ошибки размерности
Явный mapping dense_vector: dims, similarity, index_options, single-valued поле и отрицательный тест несовместимого embedding.
Почему Elasticsearch kNN возвращает меньше k результатов после фильтра
Разница pre-filter и post-filter в knn query, tenant ACL, заполнение k, num_candidates и отрицательный тест межклиентской выдачи.
Как выбрать similarity для dense_vector: cosine, dot_product или L2
Проверяемые требования Elasticsearch к cosine, dot_product, l2_norm и max_inner_product, нормализация и score formulas.
Как выполнить exact vector search в Elasticsearch через script_score
Brute-force scoring без ANN cutoff, filter для уменьшения набора, exact top-k как ground truth и сравнение с approximate kNN.
Почему Redis KNN возвращает мало результатов при фильтрации
Pre-filter в Redis Vector Search: TAG и NUMERIC до KNN, escaping tenant, проверка количества разрешённых документов и безопасный отказ.
Как измерить Recall@10 Elasticsearch kNN против exact vector search
Воспроизводимый benchmark approximate kNN: exact ground truth, одинаковый snapshot, k, num_candidates, filters, shards и p95.
Как настроить kNN Search в Elasticsearch: k и num_candidates
Рабочий запрос approximate kNN, связь k и num_candidates, HNSW, source filtering и измерение Recall@10 против exact baseline.
Почему Fireworks AI возвращает 429 и как исправить причину
Разница 429 на serverless и dedicated/on-demand, чтение заголовков лимитов, управление concurrency, backoff с jitter и нагрузочный тест.
Почему Groq API возвращает 429 и как читать rate-limit headers
Диагностика RPM, RPD, TPM, TPD, ITPM и OTPM в Groq: retry-after, оставшиеся токены, очередь, jitter и защита от шторма повторов.
Почему prediction Replicate долго в starting и как корректно отменить задачу
Разбор статусов starting, processing, succeeded, failed, canceled и aborted в Replicate; дедлайн, отмена, cold boot и безопасная диагностика.
Почему Together AI возвращает 429 и как читать x-ratelimit-reset
Динамические serverless limits, сглаживание RPM, x-ratelimit-reset, backoff с jitter и отличие от GPU quota dedicated deployment.
Как сделать Hybrid Search в Elasticsearch через BM25, kNN и RRF
Две retrieval-ветви, Reciprocal Rank Fusion, общий tenant filter, rank_window_size, конкретный JSON и оценка nDCG@10.
Как загрузить embeddings в Elasticsearch через Bulk API без частичных потерь
NDJSON для _bulk, стабильные _id, проверка errors и каждого item, refresh для теста и повторяемая загрузка embeddings.
Почему pgvector с фильтром возвращает меньше строк и как это исправить
Post-filtering ANN, hnsw.ef_search, iterative scans, B-tree, partial index и partitioning для tenant/category filters.
Почему pgvector не использует индекс: проверяем ORDER BY, LIMIT и EXPLAIN
Диагностика Seq Scan вместо HNSW/IVFFlat: форма ORDER BY, operator class, LIMIT, размер таблицы и безопасный тест planner.
Почему Pinecone возвращает 429 и как определить превышенный лимит
Диагностика 429 TOO_MANY_REQUESTS: scope namespace/index/org, request-per-second, read/write units, model throughput, backoff с jitter и нагрузочный тест.
Почему Cloudflare Workers AI возвращает 429 и как проверить лимит
Актуальные rate limits Workers AI по task type и моделям, учёт локального inference, измерение RPM, backoff с jitter и корректная диагностика 429.
Почему OpenRouter игнорирует параметр и как включить require_parameters
Как отфильтровать endpoint, которые не поддерживают response_format, tools и другие параметры: provider.require_parameters, тест и диагностика.