Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как уменьшить индекс pgvector через halfvec и binary quantization
Сравнение vector, halfvec и bit-индексов, expression index, Hamming candidates, reranking исходными embeddings и проверка recall.
Как хранить embeddings в pgvector: schema, размерность и upsert
Проектирование vector(n), стабильный ключ документа, ON CONFLICT, проверка размерности и запрет смешивания embedding-моделей.
Как выбрать квантование Qdrant: Scalar, Product или Binary
Сравнение Scalar, Product и Binary Quantization в Qdrant, настройка int8, quantile, always_ram, rescoring и измерение памяти, Recall@k и latency.
Как настроить HNSW в pgvector и подобрать ef_search по Recall@10
Создание HNSW-индекса, m, ef_construction, ef_search, SET LOCAL и честное сравнение ANN с exact search.
Как настроить IVFFlat в pgvector: lists, probes и порядок загрузки
Расчёт стартовых lists и probes, создание индекса после загрузки данных, exact baseline и диагностика неполной выдачи.
Как сделать hybrid search в pgvector: PostgreSQL FTS и RRF
Две независимые выдачи pgvector и tsvector, Reciprocal Rank Fusion, tenant filter, конкретный SQL и оценка nDCG@10.
Как установить pgvector в PostgreSQL и проверить расширение
Установка pgvector 0.8.6 для PostgreSQL 13+, CREATE EXTENSION, проверка версии и воспроизводимый smoke-тест без догадок.
Как включить iterative scan в pgvector: strict_order и relaxed_order
Настройка pgvector 0.8+ для фильтрованного ANN: strict/relaxed ordering, materialized CTE и ограничения сканирования.
Как выбрать метрику pgvector: cosine, L2 или inner product
Операторы <=>, <-> и <#>, преобразование distance в similarity, нормализованные embeddings и точный baseline для RAG.
Как создать коллекцию Qdrant с правильными vector size и distance
Практическая настройка коллекции Qdrant: размерность эмбеддинга, Cosine, Dot, Euclid или Manhattan, named vectors и контроль несовместимого вектора.
Как загрузить points в Qdrant через upsert и дождаться индексации
Идемпотентный upsert points в Qdrant: числовые и UUID ID, vector, payload, batch, wait=true, статусы acknowledged и completed, проверка retrieve.
Почему pgvector с фильтром возвращает меньше строк и как это исправить
Post-filtering ANN, hnsw.ef_search, iterative scans, B-tree, partial index и partitioning для tenant/category filters.
Как сделать RAG на Cloudflare Workers AI и Vectorize без ошибки размерности
Создание Vectorize index с dimensions и cosine, AI и Vectorize bindings, генерация embeddings одной моделью, insert/query и проверка релевантности.
Как загрузить большой датасет в Qdrant через upload_points
Массовая загрузка Qdrant Python client: генератор batches, upload_points, parallel, max_retries, стабильные ID, отключение индексации на загрузке и сверка count.
Почему pgvector не использует индекс: проверяем ORDER BY, LIMIT и EXPLAIN
Диагностика Seq Scan вместо HNSW/IVFFlat: форма ORDER BY, operator class, LIMIT, размер таблицы и безопасный тест planner.
Как считать токены до запроса Claude API и контролировать размер контекста
Как использовать Token Counting API Claude: собрать будущий запрос, оценить input tokens и решить, что сократить.
Как настроить multitenancy Milvus через partition key
Tenant field как partition key в Milvus, routing через фильтр, контроль числа partition, negative tests и границы изоляции пользователей.
Как настроить vector search LanceDB и измерить Recall@k
L2, cosine, dot и hamming в LanceDB, exact scan, ANN, nprobes, refine_factor, distance_range и проверка качества индекса.
Как создать таблицу LanceDB с точной PyArrow-схемой и Vector
Явная schema LanceDB: FixedSizeList для vector, LanceModel/Vector, nullable-поля, validators и отрицательный тест размерности.
Как задать размерность embeddings через dimensions в Ollama API
Передаём dimensions в /api/embed, проверяем длину каждого вектора и блокируем запись в индекс с несовместимой схемой.