⚠️ Эта страница автоматически переведена, и перевод может быть несовершенным.
blog-post

В 14 раз быстрее: как мы ускорили генерацию эмбеддингов в Manticore через ONNX

Автоэмбеддинги Manticore теперь в среднем примерно в 14 раз быстрее прежней реализации SentenceTransformers/Candle на том же оборудовании, с той же моделью и теми же весами — и преимущество сохраняется как при 1 клиентском потоке, так и при 32. Рассказываем, как мы перестроили бэкенд ONNX Runtime, почему отказались от внутренней батч-обработки и как подавать ...

blog-post

Как мы ускорили KNN-поиск в Manticore: двухпроходный обход HNSW, пакетная обработка и AVX-512

Три оптимизации дают ускорение HNSW-поиска по векторам до 29%: обход графа лучше использует кэш, расстояния считаются сразу для нескольких кандидатов, а AVX-512 теперь поддерживается напрямую.

blog-post

Manticore Search 27.1.5: аутентификация, шардинг таблиц, поисковый диалог и более быстрый векторный поиск

Manticore Search 27.1.5 добавляет встроенную аутентификацию и авторизацию, вводит шардинг таблиц, добавляет разговорный поиск, ускоряет векторный поиск, улучшает фасетирование и агрегации, а также включает 65 исправлений с версии 25.0.0.

blog-post

Раннее завершение KNN-поиска в Manticore Search

Как Manticore определяет, что результаты векторного поиска достаточно хороши, и останавливает его, сокращая время ответа на 50–80% с минимальной потерей точности.

blog-post

Эволюция 'More Like This'

Как More Like This работает в классическом полнотекстовом поиске, что меняют эмбеддинги и почему такой поиск удобнее выполнять в поисковом движке.

Подписаться на рассылку

Подписаться