← Volver a Derecho Chile IA

Cómo verificamos cada respuesta

Un modelo de lenguaje puede equivocarse: inventar un artículo, citar mal un fallo o dar por hecho un rol de causa que no existe. Por eso el informe que ves no es la primera versión que escribe el modelo: pasa antes por un validador automático que revisa varias cosas y corrige lo que puede corregir sin necesidad de volver a generar la respuesta.

Qué revisa el validador antes de mostrarte el informe

1. Nada de lenguaje internoFrases como "según el contexto proporcionado" o "no se encontró jurisprudencia" delatan que el modelo está hablando de su propio funcionamiento, no de tu caso. Se detectan y se elimina la oración completa.
2. Sin saludos ni preámbuloSi el informe empieza con "Estimado colega, recibí tu consulta..." en vez de ir directo al análisis, ese preámbulo se recorta.
3. Todas las secciones obligatorias, en ordenCada tipo de informe (consulta, guía de procedimiento, análisis de documento) tiene secciones que debe traer sí o sí. Si falta la última, el sistema entiende que la respuesta se cortó y la completa automáticamente.
4. Las citas textuales, contra el texto oficialCuando el informe atribuye una frase textual a un artículo, esa frase se compara con el texto real obtenido de la BCN. Si no coincide en al menos un 90 %, no se muestra como cita textual: pasa a ser una paráfrasis marcada, para no atribuirle al legislador palabras que no escribió.
5. Roles de causa y números de dictamen, verificadosUn rol o un número de dictamen que no figura en lo que efectivamente se recuperó de las fuentes oficiales se elimina de la respuesta antes de mostrarla, en vez de dejar que quede un dato inventado.

Resultados medidos, no solo una promesa

Esto no es una descripción de cómo debería funcionar: es una batería de casos reales que se ejecuta contra el sistema y mide, caso por caso, si cada revisión efectivamente se cumple. La corrida más reciente (25 casos de las áreas laboral, civil, familia, consumidor y penal, con fuentes reales de LeyChile y los buscadores oficiales, modelo Claude Sonnet 4.5) dio esto:

IndicadorAntes de este validadorDespués
Casos con todos los artículos clave en el material entregado al modelo52 %100 %
Respuestas que citan todos los artículos clave68 %96 %
Respuestas sin frases de lenguaje interno (lo que llega a verte)8 %100 %
Respuestas con todas las secciones0 %96 %
Respuestas completas, no cortadas4 %100 %
Roles o dictámenes inventados (de 25 casos)10

Una corrida de verificación posterior, el mismo día, sobre 6 casos de control (posesión, pagaré, alimentos, posesión efectiva, juzgado de policía local y contrato de trabajo) dio 100 % en cada indicador, con un informe de 4.014 palabras en promedio.

"Lo que llega a verte" y "lo que escribió el modelo" pueden diferir: el modelo a veces todavía redacta una frase de las prohibidas, pero el validador la retira antes de mostrarte el informe. Por eso el número que importa es el que describe lo que efectivamente lees.

Lo que esto no significa

Esta batería mide consistencia y disciplina del sistema, no que cada respuesta sea correcta para tu caso particular: el Derecho tiene matices que ni el mejor validador automático reemplaza. Por eso cada informe cita sus fuentes con enlace a la fuente oficial, para que puedas comprobarlas tú mismo antes de actuar, y por eso el Servicio entrega información general y no constituye asesoría legal.