From 155d4ffb132ab400c13376034f41f1978566c409 Mon Sep 17 00:00:00 2001 From: chemavx Date: Wed, 22 Jul 2026 20:50:17 +0000 Subject: [PATCH] ollama: fuera las variables ROCm, tapaban el descubrimiento de la GPU Con HSA_OVERRIDE_GFX_VERSION y HIP_VISIBLE_DEVICES puestas, ollama arranca avisando 'user overrode visible devices / if GPUs are not correctly discovered, unset and try again' y solo encuentra la CPU. Co-Authored-By: Claude Fable 5 --- ollama/ollama.yaml | 26 +++++++++++++------------- 1 file changed, 13 insertions(+), 13 deletions(-) diff --git a/ollama/ollama.yaml b/ollama/ollama.yaml index 2b2a01f..db2e5bc 100644 --- a/ollama/ollama.yaml +++ b/ollama/ollama.yaml @@ -87,19 +87,19 @@ spec: - name: OLLAMA_METRICS value: "1" # --- aceleración por la iGPU (Radeon 780M, Hawk Point) --- - # Estas tres son de ROCm y HOY NO HACEN NADA: la imagen - # ollama/ollama:0.20.7 no trae ROCm (en /usr/lib/ollama sólo hay - # cuda_v12, cuda_v13, mlx_cuda_v13, vulkan y los backends de CPU; - # no existe rocBLAS ni hipBLAS). El soporte AMD va en la etiqueta - # aparte con sufijo -rocm. Se dejan porque describen la intención y - # porque volverían a servir si algún día se pasa a esa imagen. - - name: HSA_OVERRIDE_GFX_VERSION - value: "11.0.0" # la gfx1103 de la 780M no está soportada; se hace pasar por gfx1100 - - name: HIP_VISIBLE_DEVICES - value: "0" - - name: OLLAMA_GPU - value: "1" - # El camino que SÍ funciona con esta imagen: backend Vulkan + # AQUÍ NO VAN HSA_OVERRIDE_GFX_VERSION NI HIP_VISIBLE_DEVICES. + # Son de ROCm, y esta imagen no trae ROCm (en /usr/lib/ollama sólo + # hay cuda_v12, cuda_v13, mlx_cuda_v13, vulkan y los backends de + # CPU; ni rocBLAS ni hipBLAS). Además de inútiles eran DAÑINAS: con + # ellas puestas, ollama arrancaba avisando «user overrode visible + # devices … if GPUs are not correctly discovered, unset and try + # again» y descubría sólo la CPU (total_vram="0 B"). Si algún día se + # pasa a la imagen con sufijo -rocm, volverán a tener sentido. + # + # OLLAMA_GPU y OLLAMA_METRICS tampoco existen para ollama: no + # aparecen en el volcado de «server config» de su propio arranque. + # + # El camino que sí sirve con esta imagen: backend Vulkan # (experimental desde ollama 0.12.6, pensado para iGPUs AMD/Intel # donde ROCm no llega). La imagen ya trae libggml-vulkan.so y el # driver Mesa RADV (radeon_icd.json), así que no hace falta cambiarla.