docs: alinear modelos a qwen2.5:7b + bge-m3 (iGPU activa)
Build & Deploy ResearchOwl / build-and-push (push) Successful in 14s
Build & Deploy ResearchOwl / build-and-push (push) Successful in 14s
Generación 3B→7B y embeddings a bge-m3 en README, CLAUDE.md, .env.example y k8s/deployment.yaml. Corregido el default buggy de config.py: ollama_embed_model era qwen2.5:3b (un modelo de chat) → bge-m3. Añadido OLLAMA_EMBED_MODEL donde faltaba. Nota del host público de ollama ahora tras Authentik. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
co-authored by
Claude Opus 4.8
parent
6029bebae5
commit
9653898366
@@ -2,13 +2,13 @@
|
||||
|
||||
## Contexto del proyecto
|
||||
|
||||
Eres el agente de construcción e implementación de **ResearchOwl**, un bot de Telegram que realiza investigación exhaustiva sobre cualquier tema usando scraping recursivo y Ollama (qwen2.5:3b) para procesamiento y generación de contenido.
|
||||
Eres el agente de construcción e implementación de **ResearchOwl**, un bot de Telegram que realiza investigación exhaustiva sobre cualquier tema usando scraping recursivo, Ollama (qwen2.5:7b para scoring, bge-m3 para embeddings) y Claude para la generación de contenido.
|
||||
|
||||
El homelab donde se desplegará tiene:
|
||||
- **k3s** con Traefik + cert-manager + Cloudflare DNS
|
||||
- **ArgoCD** para GitOps (repo: `k8s-manifests` en Gitea)
|
||||
- **Gitea** en `git.chemavx.xyz` + Container Registry
|
||||
- **Ollama** en `http://ollama.chemavx.xyz` con modelo `qwen2.5:3b`
|
||||
- **Ollama** (vía Service interno `ollama.ollama.svc.cluster.local:11434`): `qwen2.5:7b` para scoring y `bge-m3` para embeddings. Nota: el host público `ollama.chemavx.xyz` está tras Authentik desde 2026-07-23; los consumidores del cluster van por el Service.
|
||||
- **Telegram bot** ya existente en `@chemavx_bot`
|
||||
- Dominio base: `chemavx.xyz`
|
||||
|
||||
@@ -321,6 +321,6 @@ Uso desde Telegram:
|
||||
- **No crear un bot de Telegram nuevo** — el usuario ya tiene `@chemavx_bot`. Solo necesita configurar el token en el secret de k3s.
|
||||
- **No modificar** los manifests de k8s para añadir Ingress — el bot usa polling de Telegram, no necesita exponer ningún puerto.
|
||||
- **Ollama** ya está corriendo en el cluster. La URL `http://ollama.chemavx.xyz` es correcta.
|
||||
- Si `qwen2.5:3b` es lento para scoring de calidad, se puede desactivar el scoring con `QUALITY_THRESHOLD=0` y todos los chunks pasan directamente.
|
||||
- Si `qwen2.5:7b` es lento para scoring de calidad, se puede desactivar el scoring con `QUALITY_THRESHOLD=0` y todos los chunks pasan directamente.
|
||||
- El proyecto usa **SQLite** (coherente con el resto del homelab).
|
||||
- Respetar el `REQUEST_DELAY=1.0` para no hacer ban en las fuentes.
|
||||
|
||||
Reference in New Issue
Block a user