Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как включить int8, int4 или BBQ-квантование dense_vector в Elasticsearch
Сравнение int8_hnsw, int4_hnsw и bbq_hnsw, ограничения dimensions, oversampling, rescoring и честная оценка памяти.
Как создать dense_vector mapping в Elasticsearch без ошибки размерности
Явный mapping dense_vector: dims, similarity, index_options, single-valued поле и отрицательный тест несовместимого embedding.
Как выполнить exact vector search в Elasticsearch через script_score
Brute-force scoring без ANN cutoff, filter для уменьшения набора, exact top-k как ground truth и сравнение с approximate kNN.
Как выбрать similarity для dense_vector: cosine, dot_product или L2
Проверяемые требования Elasticsearch к cosine, dot_product, l2_norm и max_inner_product, нормализация и score formulas.
Почему dense_vector нет в _source Elasticsearch и как получить vector
Поведение exclude_source_vectors, fields, docvalue_fields, binary format, rehydration и сохранение исходной точности для аудита.
Как измерить Recall@10 Elasticsearch kNN против exact vector search
Воспроизводимый benchmark approximate kNN: exact ground truth, одинаковый snapshot, k, num_candidates, filters, shards и p95.
Как настроить kNN Search в Elasticsearch: k и num_candidates
Рабочий запрос approximate kNN, связь k и num_candidates, HNSW, source filtering и измерение Recall@10 против exact baseline.
Как сделать Hybrid Search в Elasticsearch через BM25, kNN и RRF
Две retrieval-ветви, Reciprocal Rank Fusion, общий tenant filter, rank_window_size, конкретный JSON и оценка nDCG@10.
Как загрузить embeddings в Elasticsearch через Bulk API без частичных потерь
NDJSON для _bulk, стабильные _id, проверка errors и каждого item, refresh для теста и повторяемая загрузка embeddings.
Как включить streaming в Fireworks AI API и собрать ответ без пропусков
Потоковый Chat Completions в Fireworks: stream=true, чтение delta.content, финальная сборка, UTF-8, таймаут и проверка результата.
Как уменьшить индекс pgvector через halfvec и binary quantization
Сравнение vector, halfvec и bit-индексов, expression index, Hamming candidates, reranking исходными embeddings и проверка recall.
Как включить BM25 Full Text Search в Milvus
Нативный полнотекстовый поиск Milvus 2.5+: analyzer, VARCHAR, SPARSE_FLOAT_VECTOR, FunctionType.BM25, индекс и проверка русских терминов.
Как включить iterative scan в pgvector: strict_order и relaxed_order
Настройка pgvector 0.8+ для фильтрованного ANN: strict/relaxed ordering, materialized CTE и ограничения сканирования.
Как включить Sentiment Analysis в AssemblyAI и проверить тональность фраз
sentiment_analysis=true: POSITIVE, NEUTRAL и NEGATIVE, confidence, временные интервалы, тестовые реплики и ограничения классификации.
Как включить Smart Format в Deepgram и проверить даты, числа и пунктуацию
Что реально делает smart_format=true, различия языков, задержка финализации в streaming, no_delay и A/B-проверка на контрольной записи.
Как включить streaming в Groq API и правильно собрать ответ из chunks
Потоковый Chat Completion через stream=True: обработка delta.content, пустых дельт, завершения потока и проверка собранного ответа.
Как включить ZDR в OpenRouter API для запроса с чувствительными данными
Практическая настройка provider.zdr и data_collection, проверка доступности endpoint и безопасный шаблон обработки персональных данных.
Как включить автотюнинг SpeechKit и оценить улучшение распознавания
Как включить автотюнинг SpeechKit и оценить улучшение распознавания: настройка API, пример, проверка качества и ошибки.
Как включить fine-grained tool streaming в Claude API
Как включить fine-grained tool streaming в Claude API: пошаговая настройка, пример, проверка и защита от ошибок.
Как включить speculative decoding в LM Studio и измерить ускорение
Как включить speculative decoding в LM Studio и измерить ускорение: точная настройка, пример, критерии проверки и типичные ошибки.