diff --git a/researchowl/deployment.yaml b/researchowl/deployment.yaml index b0637c5..10c6dfe 100644 --- a/researchowl/deployment.yaml +++ b/researchowl/deployment.yaml @@ -59,10 +59,15 @@ spec: key: telegram-allowed-users - name: OLLAMA_URL value: "http://ollama.ollama.svc.cluster.local:11434" + # 2026-07-23: subidos ambos al activarse la iGPU. Generación 3B→7B + # (medido: ~12,6s/doc a 100% GPU, salto de calidad claro). Embeddings + # nomic(768d, inglés)→bge-m3(1024d, multilingüe) — mismo modelo que + # roswell; los 3990 chunks existentes se re-embebieron in situ antes + # de este cambio (si no, el coseno daría 0.0 por dim distinta). - name: OLLAMA_MODEL - value: "qwen2.5:3b" + value: "qwen2.5:7b" - name: OLLAMA_EMBED_MODEL - value: "nomic-embed-text" + value: "bge-m3" - name: DB_PATH value: "/data/researchowl.db" - name: MAX_SOURCES