El problema de la decisión: marketing vs criterio técnico
Las páginas de ventas de las IAs legales se parecen entre sí. Todas prometen rapidez, exactitud, ahorro de tiempo y "fuentes oficiales". La página dice una cosa y el comportamiento real, otra. El despacho que se decide por la página, sin probar, suele encontrarse a las dos semanas con un par de afirmaciones inventadas en respuestas que ya han llegado al cliente.
Este artículo es un marco para decidir bien. Seis preguntas concretas, verificables, que cualquier IA legal debería poder responder con claridad. Las preguntas vienen de comparar herramientas reales en consultas reales, de leer las obligaciones del AI Act, y de la doctrina del caso Mata vs Avianca. Si tu proveedor responde mal a alguna, no es la herramienta que tu despacho necesita.
Pregunta 1: ¿Cuál es la arquitectura técnica? RAG vs LLM puro
La arquitectura determina la tasa de alucinación. Existen dos categorías principales:
LLM puro (IA generativa): el modelo genera la respuesta a partir de su entrenamiento. Si necesita citar una norma o sentencia, escribe una cita plausible que puede o no corresponderse con la realidad. Ejemplos: ChatGPT, Gemini, Claude en su modo conversacional estándar. El estudio de Stanford HAI midió en estas herramientas tasas de error entre el 58 y el 88 por ciento en consultas jurídicas.
RAG (Retrieval-Augmented Generation): el sistema recupera primero pasajes textuales de un corpus de fuentes oficiales y solo después genera la respuesta sobre esa base. El modelo no afirma lo que no haya recuperado. La cita que aparece en la respuesta corresponde a un pasaje real, con su enlace verificable. Ejemplos: Legatiq y un puñado de IAs jurídicas verticales europeas.
Cómo verificarlo en una demo:
- Pregunta por una sentencia muy concreta (una STS reciente sobre tu materia).
- Mira si la respuesta enlaza al texto en CENDOJ con identificador real.
- Pincha el enlace y comprueba que la sentencia existe y dice lo que la IA afirma.
Si los tres pasos cuadran, hay arquitectura RAG operativa. Si la respuesta cita la sentencia sin enlace, hay LLM generativo y riesgo profesional alto.
Pregunta 2: ¿De dónde salen las fuentes? Web abierta vs corpus oficial
La etiqueta "fuentes oficiales" se usa con holgura. Conviene apretar la pregunta:
Web abierta con búsqueda en tiempo real: la IA tiene buscador integrado y, cuando le falta el dato, va a internet a buscarlo. Puede traer un blog de derecho, una pregunta de Reddit o un foro como fuente de su afirmación. Funciona mejor que el LLM puro, pero el material no está garantizado por procedencia.
Corpus de fuentes oficiales acotado: la IA solo puede consultar un corpus restringido (BOE consolidado, CENDOJ, AEAT, TGSS, boletines autonómicos, ordenanzas municipales y convenios colectivos). Si la respuesta no está en el corpus, la IA lo declara explícitamente en lugar de inventar.
Cómo verificarlo:
- Pregunta dónde se entrena la IA y qué consulta en cada respuesta.
- Si la respuesta contiene "información de fuentes oficiales" sin lista cerrada, sigue presionando.
- Pide el listado completo de fuentes con cadencia de actualización.
Una IA seria tiene la lista pública (como Legatiq aquí). Una IA con corpus mixto (web + oficial) lo declara, y eso permite calibrar el riesgo.
Pregunta 3: ¿Hay trazabilidad real en cada respuesta?
La trazabilidad no es una funcionalidad opcional, es la condición para que la verificación humana exigida por el AI Act sea viable en flujo profesional. Las tres categorías habituales:
- Sin enlaces: la respuesta cita normas y sentencias en texto plano. Hay que ir a buscarlas a CENDOJ o BOE desde cero. Verificar cada afirmación tarda minutos. Inviable para flujo diario.
- Enlaces a páginas genéricas: la respuesta enlaza al BOE pero al portal raíz, no a la norma exacta. El usuario tiene que buscar dentro. Mejor que nada, pero verificación ineficiente.
- Enlaces directos al pasaje vigente: cada cita lleva al artículo concreto, en su versión consolidada vigente, en el portal oficial. Verificación de un clic.
Cómo verificarlo:
- Haz una consulta sobre tu materia y mira si los enlaces llevan al pasaje, no al portal raíz.
- Comprueba que el enlace abre la versión consolidada (no una versión histórica).
- Comprueba que el enlace abre el dominio oficial (
boe.es,poderjudicial.es,sede.agenciatributaria.gob.es) y no un dominio intermedio.
Sin trazabilidad real, la verificación humana del AI Act se convierte en un coste operativo prohibitivo. Con trazabilidad real, es de un clic.
Pregunta 4: ¿Cuál es la latencia y por qué?
La latencia tiene una explicación técnica directa: una IA generativa pura solo escribe sobre la marcha (segundos), una IA con RAG sobre seis capas de fuentes oficiales consulta cada capa, filtra los pasajes relevantes, los expande y construye respuesta anclada al texto recuperado (típicamente 30 a 60 segundos).
Para flujo profesional, los 30-60 segundos son tiempo asumible. Una consulta legal real cuesta minutos de pensamiento previo, lectura de la respuesta y verificación. Que la IA tarde un minuto en producir una respuesta verificable contra el BOE oficial es una ganancia neta frente a buscar tú mismo, no una pérdida.
Lo que sí debe alertar:
- Una IA jurídica que responde en menos de 5 segundos con citas. O recupera muy poco corpus, o las citas son cosméticas.
- Una IA que responde en 2 minutos sin entregar nada estructurado. Hay un cuello de botella sin valor añadido.
La latencia razonable de una IA con trazabilidad real es entre 20 segundos y 1 minuto. Más allá necesita justificación operativa.
Pregunta 5: ¿Cumple el AI Act y el RGPD?
El Reglamento UE 2024/1689 (AI Act) y el Reglamento UE 2016/679 (RGPD) son aplicables a cualquier IA usada profesionalmente. Las preguntas críticas a hacer al proveedor:
Sobre el AI Act:
- ¿La herramienta cae en la categoría de alto riesgo del Anexo III? Para asistencia jurídica directa por administración de justicia, sí; para herramientas usadas por profesionales, normalmente no, pero la transparencia del artículo 50 aplica igualmente.
- ¿Hay declaración de conformidad disponible o esperada antes de agosto de 2026 (fecha de aplicación general del AI Act para nuevos sistemas)?
- ¿Cómo se documenta la supervisión humana?
Sobre el RGPD:
- ¿Dónde se almacenan los datos del cliente y de las consultas? ¿UE u otros lugares?
- ¿Hay encargado de tratamiento que se firme antes del uso profesional?
- ¿Las consultas se usan para reentrenar el modelo? ¿Con qué consentimiento?
- ¿Hay procedimiento para ejercer derechos del RGPD (acceso, rectificación, supresión) sobre las consultas?
Cómo verificarlo:
- Pide la política de privacidad detallada, no solo el resumen.
- Pide el contrato de encargado de tratamiento.
- Mira la jurisdicción del proveedor: una entidad española o europea facilita auditoría y reclamación.
Si el proveedor evita estas preguntas o tarda en contestar, hay riesgo. Si responde con documentos firmables, está preparado para uso profesional.
Pregunta 6: ¿Cuál es el modelo de soporte y de actualización?
El soporte de una IA jurídica no es solo "tiempo de respuesta del chatbot". Lo relevante para un despacho es:
- Soporte humano cualificado: ¿hay alguien que entienda derecho español al otro lado, o solo un chatbot que reescribe FAQ?
- Reporte de errores: ¿hay procedimiento documentado para reportar respuestas incorrectas y trazar la corrección?
- Roadmap público: ¿se ve qué funcionalidades vienen y por qué? Esto importa para anticipar tu propia hoja de ruta como despacho.
- SLA de disponibilidad: ¿qué pasa si la herramienta cae un día crítico antes de un plazo procesal?
- Cadencia de actualización del corpus: ¿cómo se incorporan al sistema las normas nuevas? ¿Días? ¿Semanas?
Cómo verificarlo:
- Reporta un error real durante la prueba y mira la respuesta.
- Pregunta cuándo se incorporó al corpus la última gran reforma legal de tu área.
- Pide referencias de despachos o gestorías que ya usen la herramienta.
Una herramienta sin proceso operativo claro es buena para un usuario individual, pero arriesgada para un flujo profesional con clientes pagando.
Cuadro resumen: qué pedir en cada llamada de demostración
| Pregunta | Bandera roja | Bandera verde |
|---|---|---|
| Arquitectura | "Es como ChatGPT pero mejor" | RAG sobre corpus oficial documentado |
| Fuentes | "Información actualizada de fuentes oficiales" sin lista cerrada | Listado público con cadencias y enlaces |
| Trazabilidad | Citas en texto plano sin enlaces | Cada afirmación con enlace al pasaje vigente |
| Latencia | Respuesta en 2 segundos con citas elaboradas | Entre 20 y 60 segundos con trazabilidad real |
| Cumplimiento | Política de privacidad genérica de tres líneas | Encargado de tratamiento firmable, datos en UE |
| Soporte | Solo chatbot, sin nombres de personas | Soporte humano cualificado y roadmap público |
El criterio combinado
Una IA jurídica apta para uso profesional en derecho español en 2026 cumple las seis condiciones, no solo dos o tres. Una herramienta puede ser excelente en arquitectura y trazabilidad pero fallar en cumplimiento RGPD; ese fallo es suficiente para descartarla en un despacho que maneje datos de clientes. Una herramienta con buen soporte pero sin trazabilidad real expone al despacho al riesgo Mata. Las seis preguntas son una lista de mínimos, no una rúbrica de puntuación.
La buena noticia: las tres herramientas que sí cumplen las seis se pueden contar con los dedos de una mano en mercado español. La elección no es tan abierta como sugieren las webs de marketing. La mala noticia: distinguir entre las que cumplen y las que dicen cumplir requiere precisamente las preguntas de este artículo.
Para profundizar
Para ver una comparativa en derecho español con pruebas reales: Legatiq vs ChatGPT, Gemini y Perplexity en derecho español.
Para entender el caso fundacional sobre responsabilidad profesional con IA: caso Mata vs Avianca.
Para entender cómo las cuatro categorías de alucinación de Stanford afectan al ejercicio: alucinaciones de IA en derecho.
Preguntas frecuentes
¿Por qué la arquitectura técnica importa antes que el precio?
Porque dos IAs con interfaz parecida pueden tener tasas de error muy diferentes según cómo recuperen la información. Una IA generativa pura puede alucinar entre el 58 y el 88 por ciento de las veces en consultas legales según el estudio de Stanford. Una IA con arquitectura RAG sobre fuentes oficiales reduce el riesgo en origen. La diferencia técnica determina el riesgo profesional, y eso pesa más que la diferencia de cinco euros al mes.
¿Qué significa que una IA tenga 'fuentes oficiales' y no 'datos de entrenamiento'?
Una IA generalista aprende de todo lo que le ponen delante (web abierta, libros, foros) y luego responde sintetizando lo aprendido. Una IA con fuentes oficiales recupera pasajes textuales de un corpus restringido (BOE, CENDOJ, AEAT, TGSS) en cada consulta y construye la respuesta sobre esos pasajes. La diferencia es de procedencia: la primera no puede citar dónde se basa con verificación, la segunda sí.
¿Qué es la trazabilidad y cómo se comprueba?
Trazabilidad es la capacidad de seguir cada afirmación de la respuesta hasta su fuente original verificable. La forma de comprobarla es directa: pídele a la IA una consulta sobre tu área y mira si en la respuesta aparecen enlaces que llevan al BOE, CENDOJ o sede oficial. Si los enlaces existen, son verificables y abren el texto exacto, hay trazabilidad. Si la respuesta solo cita números de norma sin enlace, hay un problema.
¿Por qué la latencia importa, y cuál es razonable?
La latencia es el precio de la trazabilidad. Una IA generativa pura responde en segundos porque solo escribe sobre la marcha. Una IA con RAG sobre seis capas de fuentes oficiales tarda más (entre 30 y 60 segundos típicamente) porque consulta cada capa, filtra los pasajes relevantes y construye respuesta verificable. Para uso profesional, esta latencia es asumible y el resultado lo compensa. Si tu flujo de trabajo necesita milisegundos, ninguna IA jurídica seria es la respuesta.
¿Qué obligaciones impone el AI Act a la abogacía?
El Reglamento UE 2024/1689 (artículo 14) exige supervisión humana significativa sobre IA en contextos de riesgo, y el ejercicio profesional jurídico es contexto de riesgo. La supervisión incluye comprender la salida, contrastarla con la fuente y revertirla cuando sea incorrecta. Esto se hace eficiente solo si la IA entrega cita verificable. El artículo 50 añade transparencia: el usuario debe saber que interactúa con IA. Cumplir el AI Act es obligación, no recomendación.
¿Cómo se evalúa el cumplimiento de protección de datos?
Tres preguntas concretas. Primero: ¿dónde se almacenan los datos? Si están en servidores fuera de la UE sin acuerdo de transferencia, hay incumplimiento RGPD potencial. Segundo: ¿qué uso se hace de las consultas? Si se usan para reentrenar el modelo sin consentimiento explícito, hay riesgo. Tercero: ¿hay encargado de tratamiento firmado? Para uso profesional con datos de clientes, el contrato es obligatorio. Pide los tres documentos antes de pagar.
¿Qué tipo de soporte debería esperar un despacho profesional?
Más que el tiempo de respuesta del soporte, lo relevante es el tipo. ¿Hay alguien que entienda derecho español al otro lado o solo un chatbot? ¿Hay procedimiento documentado para reportar errores en respuestas y trazarlos? ¿Existe roadmap público para que veas qué viene? ¿Cuál es el SLA real de disponibilidad? Una herramienta sin estas garantías es buena para un usuario individual, pero arriesgada para un flujo profesional con clientes pagando.
¿Es razonable usar varias herramientas de IA en el mismo despacho?
Sí, y muchas veces es la decisión óptima. Una IA generalista (ChatGPT, Gemini, Claude) sigue siendo útil para borradores de redacción, brainstorming y conceptos generales bien establecidos. Una IA jurídica con fuentes oficiales (Legatiq u otras) es la herramienta para datos vigentes, citas verificables y consultas con responsabilidad profesional. El flujo eficiente combina ambas: la primera acelera la redacción, la segunda fundamenta las afirmaciones.
Fuentes oficiales consultadas
- 01
- 02Hallucinating Law: Legal Mistakes with Large Language Models are PervasiveStanford Institute for Human-Centered AI2024-01-11
- 03
- 04Código Deontológico de la Abogacía EspañolaConsejo General de la Abogacía Española
Guías relacionadas
- 14 min
IA legal en España 2026: comparativa real entre Legatiq, ChatGPT, Gemini y Perplexity
Comparativa con pruebas reales entre Legatiq, ChatGPT, Gemini y Perplexity en consultas de derecho español. Siete categorías, datos verificables y veredictos honestos.
- 15 min
Legatiq vs Perplexity en derecho español: comparativa con pruebas reales 2026
Comparativa real entre Legatiq y Perplexity en consultas de derecho español. Cuatro pruebas verificables, búsqueda en internet abierto vs biblioteca normativa por capas.
- 10 min
ChatGPT para abogados en España: ¿funciona en derecho español? Lo que la prensa no te cuenta
Análisis honesto de ChatGPT para uso profesional en derecho español: dónde funciona, dónde falla con datos reales, el caso Mata vs Avianca y la responsabilidad profesional.
- 14 min
Legatiq vs Gemini en derecho español: comparativa con pruebas reales 2026
Comparativa real entre Legatiq y Gemini 3 Pro en derecho español: cuatro pruebas verificables, errores documentados y dónde la arquitectura RAG cambia las reglas.
Pregunta tu caso a Legatiq
Cada situación legal tiene matices. Si la guía no resuelve la tuya, hazle la pregunta exacta a Legatiq y recibirás una respuesta basada en fuentes oficiales.
Probar gratis