⚠️ Эта страница автоматически переведена, и перевод может быть несовершенным.
blog-post

Manticore Search 28.4.4: быстрый рескоринг KNN, более гибкий диалоговый поиск, упрощённая установка и больше возможностей для управления фасетами

В Manticore Search 28.4.4 ускоряется KNN за счёт более быстрого рескоринга, добавляется HTTP API и custom_prompt для диалогового поиска, упрощается установка, улучшаются фасеты и настройки релевантности по умолчанию, а также исправляются проблемы с аутентификацией, репликацией, SQL и внутренними механизмами columnar/KNN.

blog-post

Turbopuffer vs Manticore Search: бенчмарк на недорогих VPS

Бенчмарк векторного поиска: 975 тыс. векторов размерности 1536, облачный сервис turbopuffer против Manticore на двух VPS за $8.25/мес - стоимость ниже примерно в 4,5 раза, сопоставимое качество поиска и разбор стоимости, задержки и пропускной способности для небольшого сценария нагрузки.

blog-post

Ускоренное построение KNN-индексов в Manticore

Теперь Manticore может строить KNN-индексы параллельно: при сохранении и слиянии чанков, а также при пересборке KNN-данных. На машине с 16 ядрами время построения KNN-индекса для 1 млн векторов сократилось с 8 минут до 39 секунд.

blog-post

Шардинг в Manticore Search: автоматическое распределение и репликация

Как работает шардинг в Manticore Search: от разбиения таблицы по ядрам CPU на одном узле до автоматического распределения по нескольким узлам с поддержанием заданного фактора репликации.

blog-post

Manticore Search + systemd: современный подход к управлению

Интеграция Manticore Search с systemd обеспечивает: уведомления о состоянии (notify), безопасное завершение при сбросе данных RT‑таблиц, логи в журнале systemd и аккуратную перезагрузку конфигурации.

blog-post

В 14 раз быстрее: как мы ускорили генерацию эмбеддингов в Manticore через ONNX

Автоэмбеддинги Manticore теперь в среднем примерно в 14 раз быстрее прежней реализации SentenceTransformers/Candle на том же оборудовании, с той же моделью и теми же весами — и преимущество сохраняется как при 1 клиентском потоке, так и при 32. Рассказываем, как мы перестроили бэкенд ONNX Runtime, почему отказались от внутренней батч-обработки и как подавать ...

Подписаться на рассылку

Подписаться