Familia 1
Riesgo de output
El sistema genera información incorrecta, inventada, incompleta o no suficientemente verificada.
- alucinaciones;
- jurisprudencia o citas falsas;
- errores de contexto;
- validación humana insuficiente.
Nueva categoría del Observatorio Tracewarden
La gobernanza de IA no termina en revisar lo que el modelo produce. Cuando un sistema ingiere archivos de terceros, también debe poder responder qué recibió, qué contenido fue considerado confiable, qué se aisló y qué evidencia quedó.
Esta categoría agrupa incidentes en los que el riesgo surge desde el input: instrucciones ocultas, contenido adversarial o estructuras documentales capaces de condicionar a un LLM, RAG, agente o sistema de análisis automatizado.
Familia 1
El sistema genera información incorrecta, inventada, incompleta o no suficientemente verificada.
Familia 2
El material recibido intenta modificar el comportamiento de la IA o incorpora contenido que no debería interpretarse como una instrucción operativa.
Casos documentados
Galileu detectó comandos ocultos dentro de una petición inicial; el sistema alertó y bloqueó el procesamiento sospechoso, seguido de verificación humana.
Un recurso contenía una instrucción oculta en fuente blanca destinada a influir en el análisis. Hubo sanciones económicas y comunicaciones a organismos profesionales y de investigación.
El tribunal de Connecticut sancionó el uso de texto oculto dirigido a cualquier IA que analizara escritos presentados electrónicamente.
El CNJ formalizó orientaciones de ingestión segura, preservación de metadatos visuales y estructurales, detección de material adversarial y supervisión humana.
Control Tracewarden
El control recomendado no consiste en “limpiar PDFs” de manera indiscriminada. Debe preservar la evidencia original y documentar cualquier transformación. El objetivo es impedir que la sanitización destruya la capacidad de explicar posteriormente qué se recibió y por qué determinado contenido fue excluido del procesamiento.
Criterio editorial
La existencia de varios precedentes no permite por sí sola sostener una tendencia estadística global. Tampoco cada instrucción oculta produce necesariamente una decisión afectada. El Observatorio registra hechos verificables y los traduce en controles; distingue el incidente comprobado de la inferencia metodológica.