Las tres infografías falladas del 27-jul no fallaron al dibujar, fallaron al
decidir qué era cierto. ChatGPT tenía el artículo anterior en el contexto de la
conversación y coló la ficha de Vilas-Boas dentro de la infografía de Talavera,
y los 84 expedientes del Ejército del Aire español dentro de la de Vilas-Boas.
En una llegó a inventarse un dominio, bibliotecavirtual.defesa.gov.br, que no
existe: una brasileñización del español, a un clic de publicarse.
La respuesta no es pedirle al modelo que se porte bien, es no dejarle decidir.
El guion se extrae del artículo (claude -p, coste cero) y se VERIFICA contra el
propio artículo antes de que ChatGPT vea nada. A ChatGPT le llega "maqueta este
texto", no "lee esto y decide qué es cierto".
Decisiones que no son de adorno:
- La verificación es regex sobre el artículo, sin modelo de por medio. Un
modelo autoevaluándose es exactamente lo que ya falló tres veces.
- Tres severidades, sacadas de cómo falló esto en la vida real: nombre propio
fuera del artículo se cae, URL fuera del artículo se cae sin excepciones, y
cifra que no aparece literal solo avisa. Lo tercero porque el artículo dice
"mil novecientas páginas" donde el guion escribe "1.900", y tumbar eso
automáticamente daría más falsos positivos que aciertos. Los nombres propios
fueron el 100% de la contaminación observada.
- Los títulos de panel NO se verifican: "DATOS DEL CASO" es una etiqueta
editorial, no una afirmación sobre el caso, y no tiene por qué aparecer en el
artículo. Verificarlos hacía caer todos los paneles y el informe se volvía
inservible.
- Una mayúscula en inicio de frase no cuenta como nombre propio, o cualquier
viñeta que empiece por verbo ("Llegan…", "Comienza…") sale marcada como
forastera. Las siglas (SBEDV, APRO, OVNI) sí se persiguen en cualquier
posición: son marcador de contaminación.
- Se compara plegando minúsculas y tildes. El modelo escribe "Neron" donde el
artículo dice "Nerón" y eso no es contaminación; la de verdad son palabras
que no están en el artículo de ninguna forma.
- El idioma lo fija --site, no se adivina del texto: es un dato duro que no se
equivoca, y el idioma del guion arrastra el de la imagen.
Verificado con la avería real, no con un caso de laboratorio: al guion
contaminado de Talavera se le caen Vilas-Boas, Martins, Fontes, Bühler, SBEDV,
Creighton, São Francisco de Sales y el dominio inventado, y se eliminan enteros
los dos paneles que se quedan sin viñetas, mientras los legítimos sobreviven
sin un solo falso positivo. Sobre los dos artículos publicados hoy, extrayendo
de cero: 0 descartes y 0 avisos en ambos, guion inglés íntegro en inglés y
español íntegro en español.
Solo lectura sobre Ghost: no toca el post, no publica, no genera imágenes.
El wrapper ~/.local/bin/infografia queda fuera del repo, como seo-check.
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>