nomic-embed-text на русском не работал: в замере «велосипедная камера» набирала мультиметру 0.704 — больше, чем верный ответ на «паяльник» (0.691). Зазор −0.013, то есть мусор систематически обгонял правильное и порогом это не лечилось. bge-m3 на том же наборе: верные не ниже 0.537, мусор не выше 0.460, зазор +0.077. Префиксы задачи ему не нужны, поэтому обнулены. Порог откалиброван на настоящей базе, а не на придуманном наборе, и картина там честнее: абстрактное «чем посветить» набирает лампам 0.411, а посторонняя «детская коляска» — 0.535. Полностью не разделяются, поэтому SEMANTIC_MIN выставлен так, чтобы отсечь весь мусор ценой слабых догадок — уверенно показанное не то хуже честного «не нашёл». Точных запросов это не касается: они находятся по словам и тегам. Добавлен tools/reindex.py: смена эмбеддера требует полного пересчёта векторов, иначе смешанная база тихо портит поиск. Скрипт делает копию перед работой. Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
19 lines
904 B
Bash
19 lines
904 B
Bash
# Пример настроек. Скопируйте в .env и поправьте под себя.
|
|
# Файл .env в репозиторий не попадает.
|
|
|
|
# Адрес Ollama. Если Ollama на этом же компьютере — оставьте localhost.
|
|
# Если на другой машине в локальной сети — укажите её адрес.
|
|
OLLAMA_HOST=http://localhost:11434
|
|
|
|
# Модель для разбора свободных фраз. Должна быть установлена в Ollama:
|
|
# ollama pull qwen2.5:7b
|
|
# HLAMINGO_CHAT_MODEL=qwen2.5:7b
|
|
|
|
# Модель для эмбеддингов (поиск по смыслу). Необязательна — без неё
|
|
# работает поиск по словам и тегам:
|
|
# ollama pull bge-m3
|
|
# HLAMINGO_EMBED_MODEL=bge-m3
|
|
|
|
# Порт веб-интерфейса.
|
|
# HLAMINGO_PORT=5000
|