Поиск.
Найдено: 0 моделей и 20 материалов
Материалы
Как выбрать vector index LanceDB: IVF_PQ, IVF_RQ или IVF_HNSW
Сравнение индексов LanceDB по recall, latency и сжатию: IVF_PQ, IVF_RQ, IVF_HNSW_FLAT/SQ, metric и контроль build status.
Как создать таблицу LanceDB с точной PyArrow-схемой и Vector
Явная schema LanceDB: FixedSizeList для vector, LanceModel/Vector, nullable-поля, validators и отрицательный тест размерности.
Как настроить HNSW в pgvector и подобрать ef_search по Recall@10
Создание HNSW-индекса, m, ef_construction, ef_search, SET LOCAL и честное сравнение ANN с exact search.
Как настроить vector search LanceDB и измерить Recall@k
L2, cosine, dot и hamming в LanceDB, exact scan, ANN, nprobes, refine_factor, distance_range и проверка качества индекса.
Как настроить IVFFlat в pgvector: lists, probes и порядок загрузки
Расчёт стартовых lists и probes, создание индекса после загрузки данных, exact baseline и диагностика неполной выдачи.
Почему pgvector с фильтром возвращает меньше строк и как это исправить
Post-filtering ANN, hnsw.ef_search, iterative scans, B-tree, partial index и partitioning для tenant/category filters.
Как фильтровать поиск LanceDB: prefilter или postfilter
SQL where в LanceDB, tenant и visibility, prefilter по умолчанию, postfilter, scalar index и отрицательный тест межклиентской выдачи.
Как настроить hybrid search LanceDB с RRFReranker
Объединение vector search и FTS в LanceDB, query_type=hybrid, RRFReranker, normalize, фильтр обеих ветвей и оценка nDCG.
Как уменьшить индекс pgvector через halfvec и binary quantization
Сравнение vector, halfvec и bit-индексов, expression index, Hamming candidates, reranking исходными embeddings и проверка recall.
Как выбрать метрику pgvector: cosine, L2 или inner product
Операторы <=>, <-> и <#>, преобразование distance в similarity, нормализованные embeddings и точный baseline для RAG.
Как создать named vectors в Weaviate для разных полей
Несколько embeddings на object: named vectors для title и title+country, source_properties, отдельные indexes, target_vector и добавление vector в 1.31+.
Как включить iterative scan в pgvector: strict_order и relaxed_order
Настройка pgvector 0.8+ для фильтрованного ANN: strict/relaxed ordering, materialized CTE и ограничения сканирования.
Как сделать RAG на Cloudflare Workers AI и Vectorize без ошибки размерности
Создание Vectorize index с dimensions и cosine, AI и Vectorize bindings, генерация embeddings одной моделью, insert/query и проверка релевантности.
Как настроить HNSW-индекс ChromaDB и измерить Recall
HNSW configuration ChromaDB: space, ef_construction, ef_search, max_neighbors, build_threads, resize_factor и тест качества/скорости.
Как настроить русский Full-Text Search в LanceDB
FTS-индекс LanceDB для русского текста: language, stop words, stemming, lowercase, phrase positions, fuzzy search и проверка кодов.
Как обновлять данные LanceDB через merge_insert без дублей
Update и merge_insert в LanceDB: сопоставление по ключу, when_matched_update_all, when_not_matched_insert_all и проверка идемпотентности.
Как подключиться к LanceDB из Python: локально, object storage или Enterprise
Выбор URI LanceDB для локального каталога, S3/GCS/Azure и Enterprise, безопасные credentials, список таблиц и проверка подключения.
Как восстановить версию таблицы LanceDB и сохранить воспроизводимость
Автоматические версии LanceDB, list_versions, checkout, restore, checkout_latest, tags и безопасная проверка rollback перед cleanup.
Как загрузить большой датасет в LanceDB без переполнения памяти
Потоковая загрузка LanceDB через table.add, PyArrow Dataset и RecordBatch iterator, manifest, parallel writes и сверка количества строк.
Как хранить embeddings в pgvector: schema, размерность и upsert
Проектирование vector(n), стабильный ключ документа, ON CONFLICT, проверка размерности и запрет смешивания embedding-моделей.