La IA entra en el trabajo contractual:
OpenAI e Ironclad desarrollaron una colaboración de investigación para entrenar y evaluar agentes de inteligencia artificial en tareas vinculadas con contratos, aprobaciones y cláusulas jurídicas. Las pruebas muestran avances, pero también una limitación decisiva: el mejor modelo evaluado alcanzó una puntuación media del 55%. La experiencia permite observar hacia dónde puede dirigirse la automatización del trabajo contractual y por qué la supervisión humana continúa siendo determinante.
La inteligencia artificial aplicada al derecho comienza a atravesar una nueva frontera.
Durante los últimos años, buena parte de la discusión se concentró en sistemas capaces de redactar, resumir o revisar documentos.
Ahora, el desafío empieza a ser diferente: que un agente de IA pueda desenvolverse dentro de un proceso contractual, utilizar software especializado, ejecutar múltiples pasos y respetar las reglas que una organización estableció para aprobar una operación.
OpenAI anunció el 6 de octubre de 2026 una colaboración de investigación con Ironclad, plataforma especializada en gestión contractual, destinada precisamente a estudiar ese problema.
De redactar un contrato a intervenir en su gestión
La diferencia es importante.
Un proceso contractual empresarial puede involucrar simultáneamente al departamento jurídico, Finanzas, Seguridad, Compras y otras áreas.
Supongamos que una empresa quiere adquirir software.
Por encima de determinada suma puede requerirse aprobación financiera. Ciertas adquisiciones pueden necesitar una evaluación de seguridad. Y las cláusulas que se aparten de los estándares de la compañía pueden requerir intervención del departamento jurídico.
Un agente que opere dentro de ese sistema no solamente debe comprender una instrucción.
Debe mantener las reglas durante todo el procedimiento, ejecutar las acciones correspondientes y verificar que los diferentes escenarios recorran correctamente los circuitos establecidos.
Ese es el tipo de problema que OpenAI e Ironclad están utilizando para entrenar y evaluar agentes.
Once tareas de trabajo jurídico, comercial y de compras
Especialistas de Ironclad y usuarios de la plataforma dentro de OpenAI identificaron 11 tareas pertenecientes a las áreas jurídica, comercial y de compras.
Entre los ejemplos informados se encuentran:
- configurar acuerdos de confidencialidad;
- crear procesos de aprobación para adquisiciones;
- modificar una cláusula jurídica reutilizable de acuerdo con la jurisdicción seleccionada por quien realiza la solicitud.
Cada tarea fue evaluada mediante entre 8 y 50 criterios, dependiendo de su complejidad.
Según OpenAI, un usuario experimentado necesitaría aproximadamente entre 30 y 40 minutos, en promedio, para completar cada una de esas tareas.
El resultado muestra avance, pero también cuánto falta
OpenAI comparó GPT-6 Astra con GPT-5.6 Sol dentro de estas pruebas.
Astra obtuvo una puntuación media del 55,0%, mientras que GPT-5.6 Sol alcanzó 41,6%.
El tiempo medio estimado por intento fue de 19,2 minutos para Astra y 37 minutos para Sol.
Un modelo interno utilizado durante el desarrollo de Astra alcanzó una puntuación del 63,7%.
Pero estos números requieren una aclaración esencial.
OpenAI advierte que los resultados corresponden exclusivamente a las 11 tareas de investigación seleccionadas y no representan todos los procesos de Ironclad. Además, los tiempos son estimaciones simuladas basadas en velocidades de procesamiento y generación: no constituyen mediciones de ahorro de tiempo obtenidas por clientes reales.
Por lo tanto, el anuncio no demuestra que una IA pueda actualmente administrar de manera autónoma y fiable cualquier proceso contractual.
Demuestra algo diferente: que los modelos están siendo entrenados para avanzar desde tareas aisladas hacia flujos profesionales completos.
Los contratos utilizados para entrenar las pruebas
Otro aspecto merece atención.
OpenAI informa que las tareas sintéticas utilizadas para el entrenamiento fueron creadas a partir de contratos disponibles públicamente en la base EDGAR de la Securities and Exchange Commission de Estados Unidos, después de aplicar filtros destinados a eliminar información personal.
La compañía afirma que no utilizó para este entrenamiento y evaluación datos de clientes de OpenAI, contratos internos de OpenAI ni contratos o datos no públicos de clientes de Ironclad.
Esta precisión resulta especialmente relevante en el ámbito jurídico, donde los documentos utilizados para entrenar, evaluar u operar sistemas de IA pueden contener información confidencial, datos personales y secretos comerciales.
El verdadero cambio: agentes que actúan
Desde una perspectiva jurídica y profesional, la importancia del experimento no reside únicamente en la mejora de rendimiento entre dos modelos.
El cambio conceptual es mayor.
Una herramienta generativa tradicional puede recibir una cláusula y proponer otra redacción.
Un agente que opera sobre un sistema de gestión contractual puede, en cambio, ser diseñado para interpretar requisitos, desplazarse por una aplicación, configurar reglas y ejecutar una secuencia de acciones.
Esto modifica el problema de gobernanza.
Cuantas más acciones pueda ejecutar el sistema, más importante resulta determinar cuáles puede realizar autónomamente, cuáles requieren autorización humana y cuáles deben quedar registradas para permitir una auditoría posterior.
¿Quién controla al agente?
La propia publicación de OpenAI e Ironclad ofrece una respuesta significativa.
La colaboración reconoce que un proceso contractual debe contemplar excepciones sin perder las reglas empresariales que lo gobiernan.
Si un agente pierde una regla durante la ejecución de una tarea, disminuye aquello que puede confiársele.
Por esa razón, OpenAI señala expresamente que la supervisión humana sigue siendo importante mientras los agentes avanzan en tareas contractuales complejas.
La cuestión resulta central para el derecho.
El desafío no consiste únicamente en conseguir que una inteligencia artificial complete una tarea.
Consiste en poder determinar que la completó correctamente, dentro de sus facultades y respetando las reglas aplicables.
La IA no elimina el circuito jurídico: puede pasar a formar parte de él
Los datos disponibles tampoco permiten afirmar que estos sistemas estén reemplazando abogados o departamentos jurídicos.
El experimento estudia la capacidad de los agentes para ejecutar determinados procesos dentro de software especializado.
De hecho, los propios resultados muestran que todavía existe una distancia considerable respecto de un cumplimiento perfecto de los criterios evaluados.
La perspectiva más interesante es otra.
Si estos sistemas continúan mejorando, una parte del trabajo operativo que actualmente rodea al contrato podría ser ejecutada por agentes bajo reglas previamente definidas.
Eso puede desplazar progresivamente el trabajo humano desde la ejecución de determinados pasos hacia tareas de diseño de reglas, definición de excepciones, autorización, supervisión y control.
Una advertencia para interpretar estos resultados
Existe otra distinción necesaria.
La información publicada proviene de OpenAI sobre una investigación realizada conjuntamente con Ironclad.
No se trata de un estudio académico independiente ni de una auditoría externa de desempeño.
Por ello, los resultados deben interpretarse dentro de ese contexto y sin extrapolarlos a todo el mercado de tecnología jurídica o a cualquier clase de contrato.
El dato relevante es que dos compañías están utilizando procesos contractuales reales como referencia para investigar cómo los agentes pueden operar dentro de software profesional.
Del documento al proceso
Durante años, la inteligencia artificial aplicada al derecho fue observada fundamentalmente como una herramienta capaz de trabajar sobre documentos.
La investigación de OpenAI e Ironclad permite visualizar una etapa diferente: sistemas que comienzan a trabajar sobre procesos.
Y esa diferencia puede resultar mucho más trascendente.
Porque cuando la inteligencia artificial deja de limitarse a sugerir una redacción y comienza a ejecutar acciones dentro de un procedimiento contractual, aparecen preguntas nuevas:
¿Qué puede decidir el agente?
¿Qué debe aprobar necesariamente una persona?
¿Cómo se registra lo que hizo?
¿Cómo se detecta un error antes de que produzca consecuencias?
¿Y quién asume la responsabilidad por una decisión ejecutada mediante el sistema?
La investigación publicada no pretende resolver esas cuestiones jurídicas.
Pero muestra por qué comenzarán a ser cada vez más importantes.
El futuro de la inteligencia artificial jurídica podría no consistir solamente en máquinas que ayuden a escribir contratos.
Podría consistir en agentes que participen en los procesos mediante los cuales esos contratos se crean, revisan, aprueban y administran.
Y allí la supervisión humana deja de ser solamente una recomendación tecnológica para convertirse en una cuestión central de gobernanza.
Fuente principal
OpenAI, Advancing computer use with Ironclad, 6 de octubre de 2026.
Transparencia
Contenido elaborado a partir de la publicación original de OpenAI y documentación técnica relacionada, con asistencia de inteligencia artificial y revisión editorial.
Las consideraciones sobre responsabilidad, supervisión, trazabilidad y consecuencias para la profesión jurídica constituyen análisis editorial a partir de los hechos informados y no conclusiones atribuidas a OpenAI o Ironclad.
