La frase que cambió la conversación sobre IA en derecho
El 22 de junio de 2023, el juez P. Kevin Castel del Distrito Sur de Nueva York firmó una resolución de doce páginas que se ha convertido en el precedente más citado en cualquier conversación seria sobre el uso de IA generativa por profesionales del derecho. Su frase central, traducida del inglés:
"Existen muchas razones legítimas para usar inteligencia artificial generativa en la asistencia jurídica. Los abogados de [esta parte] abandonaron sus responsabilidades cuando presentaron opiniones inexistentes con citas y referencias falsas creadas por ChatGPT, y luego siguieron defendiendo dichas opiniones falsas tras cuestionarse su existencia."
La sanción fue concreta: 5.000 dólares de multa al letrado y al despacho, y carta de disculpa firmada a cada uno de los jueces a los que ChatGPT había atribuido falsamente esas opiniones.
El caso, Mata v. Avianca, Inc., 22-cv-01461 (S.D.N.Y.), no es una anécdota. Es el primer precedente público en el que un tribunal sanciona formalmente la presentación de documentos procesales fabricados por IA generativa. Y aunque proceda de Nueva York, la doctrina que destila es universal: aplicable directamente al ejercicio profesional en España, donde el Código Deontológico de la Abogacía y el AI Act europeo refuerzan el deber de verificación humana.
Los hechos: cómo seis sentencias inventadas llegaron a un tribunal federal
Roberto Mata demandó a la aerolínea Avianca por una lesión que sufrió a bordo de un vuelo en 2019, cuando un carrito de servicio le golpeó la rodilla. Avianca pidió desestimar la demanda alegando que el plazo de prescripción del Convenio de Montreal había expirado. La defensa de Mata, llevada por el bufete Levidow, Levidow & Oberman P.C., debía argumentar que el plazo no había prescrito.
El abogado encargado, Steven A. Schwartz, llevaba más de treinta años ejerciendo, pero por primera vez había decidido apoyarse en ChatGPT (versión 3.5 en aquel momento) para investigar precedentes jurisprudenciales. El 1 de marzo de 2023 presentó un escrito de oposición que citaba seis sentencias supuestamente favorables a su tesis:
- Varghese v. China Southern Airlines Co. Ltd., 925 F.3d 1339 (11th Cir. 2019)
- Shaboon v. EgyptAir, 2013 IL App (1st) 111279-U (Ill. App. Ct. 2013)
- Petersen v. Iran Air, 905 F. Supp 2d 121 (D.D.C. 2013)
- Martinez v. Delta Airlines, Inc., 2019 WL 4639462 (Tex. App. Sept. 25, 2019)
- Estate of Durden v. KLM Royal Dutch Airlines, 2017 WL 2418825 (Ga. Ct. App. June 6, 2017)
- Miller v. United Airlines, Inc., 174 F.3d 366 (2d Cir. 1999)
Las seis eran inexistentes. Los nombres parecían plausibles, los números de caso seguían el formato real de los reporteros oficiales, las citas internas eran coherentes en estilo legal. Pero ninguna de esas sentencias había sido nunca dictada por ningún tribunal. ChatGPT las había generado completas: el caso, las partes, los hechos, el razonamiento del juez y los extractos relevantes para el argumento de Schwartz.
Cómo se descubrió la fabricación
Cuando los abogados de Avianca y el propio juez Castel intentaron localizar las sentencias en bases de datos jurídicas (Westlaw, LexisNexis y los reporteros oficiales) ninguna apareció. El tribunal pidió a la defensa de Mata que aportara las opiniones completas como anexo.
Schwartz volvió a ChatGPT y le pidió los textos completos. ChatGPT le entregó opiniones jurídicas detalladas, con razonamientos elaborados que parecían verosímiles. Schwartz las anexó al expediente.
El juez Castel comparó esos textos con los reporteros oficiales y confirmó que no existían. Convocó audiencia de sanciones, en la que Schwartz declaró bajo juramento que había preguntado a ChatGPT si las sentencias eran reales, y ChatGPT había respondido afirmativamente, ofreciendo además extractos confirmatorios. La IA, en otras palabras, había validado su propia invención.
El razonamiento del juez Castel
La resolución es notable por su tono mesurado. El juez no condenó el uso de IA por abogados ni promovió ningún tipo de prohibición. Lo que condenó fue el incumplimiento del deber profesional de verificación.
Sus puntos clave, parafraseados:
- El uso de IA generativa no está prohibido. Lo que está prohibido es presentar al tribunal afirmaciones cuya veracidad el letrado no ha comprobado.
- La verificación no se delega en la propia IA. Pedir a ChatGPT que confirme lo que ChatGPT ha dicho no es verificación: es una redundancia técnicamente impotente.
- La diligencia exige fuentes primarias. Westlaw, LexisNexis o los reporteros oficiales son las fuentes adecuadas para confirmar que una sentencia existe; no lo es la propia herramienta generativa.
- El deber de honestidad ante el tribunal es absoluto. Cuando los letrados detectaron las dudas sobre las citas y aún así las defendieron, agravaron la falta original.
El resultado: 5.000 dólares de sanción solidaria, cartas de explicación a cada juez al que ChatGPT había atribuido falsamente la autoría de las sentencias, y una marca pública en la carrera de Schwartz que se ha convertido en caso de estudio en facultades de derecho de medio mundo.
Por qué importa en España
Mata vs Avianca es un caso del Distrito Sur de Nueva York, no es jurisprudencia en España. Pero la doctrina que enuncia se solapa con tres marcos legales españoles y europeos plenamente aplicables aquí:
El Código Deontológico de la Abogacía Española
El Código Deontológico de la Abogacía Española, aprobado por el Pleno del Consejo General y vinculante para todos los colegiados, establece en su artículo 11 que el abogado debe actuar con la diligencia que exigen las circunstancias del caso. Citar una sentencia inventada en un escrito procesal contraviene directamente este principio: la diligencia exige verificación de cada afirmación que se firma.
El artículo 30 sobre defensa técnica refuerza el punto: el abogado responde de la calidad técnica de su intervención. Una intervención técnica que se apoya en sentencias inexistentes es por definición negligente, con independencia de quién o qué las haya producido.
El AI Act europeo (Reglamento UE 2024/1689)
El Reglamento de Inteligencia Artificial, aplicable progresivamente desde 2024, establece en su artículo 14 la obligación de supervisión humana significativa sobre los sistemas de IA usados en contextos de riesgo. La administración de justicia y la asistencia jurídica entran en esta categoría: las afirmaciones que la IA produce y que llegan a un tribunal deben ser revisadas por una persona cualificada antes de su uso oficial.
El AI Act no prohíbe el uso de IA generativa por abogados. Formaliza una obligación que ya estaba en el sentido común de la profesión: la persona firma, la persona responde, y la herramienta es eso, una herramienta.
La responsabilidad civil del abogado frente a su cliente
En España, la responsabilidad civil del abogado frente a su cliente está regulada por el artículo 1101 y siguientes del Código Civil y por la jurisprudencia del Tribunal Supremo en materia de mandato profesional. La presentación de citas inventadas en un escrito que perjudique al cliente puede dar lugar a reclamación por daños y perjuicios.
La pregunta no es si Mata vs Avianca aplica formalmente en España. La pregunta es si un abogado español que cite a un tribunal una sentencia inventada por ChatGPT puede defenderse alegando buena fe. La respuesta, a la luz de los tres marcos anteriores, es claramente no.
La pauta de fondo: alucinación es una propiedad estructural, no un fallo puntual
El estudio publicado en enero de 2024 por Stanford Institute for Human-Centered AI (Hallucinating Law: Legal Mistakes with Large Language Models are Pervasive) midió la tasa de error de los modelos generalistas en consultas jurídicas y encontró cifras entre el 58 y el 88 por ciento dependiendo del tipo de pregunta y del modelo evaluado. Las categorías más afectadas:
- Existencia de sentencias: el modelo afirma que existe una sentencia que no existe.
- Atribución de autoría: el modelo asigna una opinión a un juez que nunca la dictó.
- Cita literal de pasajes: el modelo extrae párrafos que parecen del texto pero que la sentencia real nunca contuvo.
- Vigencia normativa: el modelo cita una norma derogada como vigente.
Mata vs Avianca no fue un fallo aislado. Fue la primera manifestación pública de un patrón estructural: los modelos generalistas tienen, por arquitectura, capacidad para producir afirmaciones plausibles que no están en sus fuentes. La arquitectura RAG sobre fuentes oficiales (que es la que usa Legatiq) reduce drásticamente este riesgo precisamente porque el modelo no afirma lo que no haya recuperado del corpus oficial. La diferencia importa.
Qué hacer si ya estás usando IA en el ejercicio profesional
La doctrina Mata se traduce en flujo de trabajo concreto:
- Nunca cites a un tribunal lo que la IA dice sin verificarlo en la fuente primaria. Si la IA cita una sentencia, abre CENDOJ y comprueba que existe. Si cita un artículo del BOE, abre el BOE consolidado y verifica que el texto coincide.
- Prefiere IA con citas verificables a IA generativa pura. Las herramientas tipo Legatiq con arquitectura RAG entregan el enlace al BOE oficial junto a la afirmación. La verificación es de un clic. La generativa pura te entrega la afirmación sin enlace, y tú tienes que ir a buscar la fuente desde cero, asumiendo que existe.
- Documenta la verificación en el expediente del caso. Una nota al margen, un anexo interno, una captura de pantalla del enlace al BOE: cualquier huella sirve para acreditar diligencia si la calidad técnica de la intervención se cuestiona después.
- Forma al equipo del despacho. Pasantes, becarios y abogados junior tienen la misma responsabilidad técnica que el socio firmante. La política de uso de IA debe estar escrita y conocida.
El caso Mata es la versión documentada de algo que la profesión ya intuía. Ahora tiene número de expediente, sentencia firme y multa. Vale la pena tenerlo presente en cualquier flujo de trabajo en el que la IA esté implicada.
Para profundizar en derecho español
Para entender por qué las IA generalistas producen estas alucinaciones y qué arquitecturas las evitan, por qué no debes confiar en una IA genérica para temas legales.
Para ver cómo se compara Legatiq con ChatGPT en consultas reales de derecho español, ChatGPT para abogados en España: análisis honesto.
Para entender cómo está construida una IA jurídica con arquitectura RAG sobre fuentes oficiales, Legatiq no es un chatbot: arquitectura de una IA jurídica.
Preguntas frecuentes
¿Qué pasó exactamente en el caso Mata vs Avianca?
Roberto Mata demandó a Avianca por una lesión a bordo de un vuelo. La aerolínea pidió desestimar la demanda alegando prescripción. El abogado de Mata, Steven Schwartz, presentó un escrito de oposición el 1 de marzo de 2023 citando seis sentencias en su favor. Cuando el tribunal y la otra parte intentaron localizar las citas, descubrieron que las seis eran inexistentes: nombres, números de caso, jueces y razonamientos habían sido fabricados por ChatGPT. El juez Castel sancionó al letrado con 5.000 dólares y exigió cartas de explicación a los jueces falsamente atribuidos.
¿Cuántas sentencias inventadas presentó el abogado?
Seis. Entre ellas figuraban Varghese v. China Southern Airlines, Shaboon v. EgyptAir, Petersen v. Iran Air, Martinez v. Delta Airlines, Estate of Durden v. KLM Royal Dutch Airlines y Miller v. United Airlines. Ninguna existía. ChatGPT había generado los nombres, los números de caso, las citas internas y hasta opiniones jurídicas plausibles pero ficticias.
¿Qué argumentó el abogado en su defensa?
Schwartz alegó buena fe: dijo desconocer que ChatGPT pudiera inventar información y declaró que cuando pidió a la herramienta confirmar si las sentencias eran reales, ChatGPT respondió afirmativamente y le ofreció extractos detallados. El juez Castel rechazó la defensa: la diligencia profesional exige verificar las fuentes en bases de datos jurídicas reconocidas, no consultar a la propia IA generativa para confirmar lo que ella misma ha producido.
¿Por qué importa este caso en España si es de Estados Unidos?
La doctrina del caso Mata es universal y aplicable directamente en España: el Código Deontológico de la Abogacía Española obliga a la diligencia técnica del letrado en todo escrito que firma. El AI Act europeo (Reglamento UE 2024/1689) refuerza el deber de verificación humana en sistemas de IA. Las salas de jueces y los colegios profesionales en España citan ya el precedente como referencia ilustrativa del riesgo.
¿Hay riesgo real de que ChatGPT invente sentencias en derecho español?
Sí, y los datos lo confirman. El estudio de Stanford HAI (enero 2024) midió tasas de error del 58 al 88 por ciento en consultas legales a modelos generalistas. El derecho español no está exento: Legatiq y otros profesionales han documentado en sus pruebas inventos como referencias a la 'Ley 6/2017 del Estatuto del Trabajador Autónomo' (la ley correcta es la 20/2007) o sentencias del TS con números compuestos que no aparecen en CENDOJ.
¿Cuál es la responsabilidad del abogado que cita una sentencia inventada por una IA?
Plena. La IA no es parte del despacho ni asume responsabilidad legal. El abogado que firma un escrito responde de la veracidad de cada afirmación frente al cliente, frente al tribunal y frente al Colegio. Citar una sentencia que no existe puede invalidar la alegación, hacer perder el caso, generar responsabilidad civil ante el cliente y, como muestra Mata, sanciones disciplinarias. El AI Act lo formaliza: la verificación humana es obligación, no recomendación.
¿Cómo evitar el riesgo si se quiere usar IA en el ejercicio profesional?
Tres reglas mínimas. Primero: nunca citar a un tribunal lo que la IA dice sin verificarlo en la fuente original (BOE, CENDOJ, sede AEAT). Segundo: preferir IA jurídicas con arquitectura RAG sobre fuentes oficiales que entreguen el enlace verificable, no la mera afirmación. Tercero: documentar en el expediente del caso la verificación realizada, para acreditar diligencia si surge controversia. Esto es lo que la doctrina Mata enseña, traducido a flujo de trabajo.
¿Hubo más casos similares después de Mata vs Avianca?
Sí. En Estados Unidos se han documentado varios casos posteriores con sanciones a letrados que presentaron citas fabricadas por IA, incluyendo a abogados con licencia recortada o suspendida temporalmente por colegios estatales. La pauta es consistente: lo que en 2023 fue novedoso, en 2024 y 2025 ya es jurisprudencia disciplinaria establecida en varias jurisdicciones. El caso Mata sigue siendo el referente porque fue el primero y el mejor documentado.
Fuentes oficiales consultadas
- 01Mata v. Avianca, Inc., 22-cv-01461 (S.D.N.Y. 22 jun. 2023), Opinion and Order on SanctionsU.S. District Court, Southern District of New York
22-cv-014612023-06-22 - 02Hallucinating Law: Legal Mistakes with Large Language Models are PervasiveStanford Institute for Human-Centered AI2024-01-11
- 03
- 04Código Deontológico de la Abogacía EspañolaConsejo General de la Abogacía Española
Guías relacionadas
- 8 min
Por qué no debes confiar en una IA genérica para temas legales
Confiar en ChatGPT u otra IA generalista para una consulta legal es un riesgo profesional real. El caso Mata vs Avianca, los estudios de Stanford y la responsabilidad.
- 9 min
Alucinaciones de IA en derecho: las cuatro categorías que documenta Stanford y cómo evitarlas
Stanford midió 58 a 88 por ciento de error en consultas legales a IA generalista. Las cuatro categorías de fallo y por qué la arquitectura RAG las reduce en origen.
- 8 min
AI Act y abogacía: las obligaciones reales que se aplican desde 2026
El Reglamento UE 2024/1689 cambia el marco profesional para todo despacho que use IA. Calendario, supervisión humana, transparencia y deber deontológico. Lo que cambia y lo que no.
Pregunta tu caso a Legatiq
Cada situación legal tiene matices. Si la guía no resuelve la tuya, hazle la pregunta exacta a Legatiq y recibirás una respuesta basada en fuentes oficiales.
Probar gratis