Volver a las novedades

Cómo revisar código escrito por varios agentes de IA

Respuesta corta: revisa en el orden inverso al que usas con personas. Empieza por lo que el cambio no debería haber tocado, luego mira si existe una prueba que fallaría si eso estuviera mal, y solo entonces lee el código. Un agente de IA escribe código que parece correcto con mucha más facilidad de la que escribe código correcto, y la lectura línea a línea es justo donde esa apariencia engaña.

Por qué cambia el orden

Con un colega confías en la intención y revisas la ejecución. Con un agente de IA, la intención es la parte incierta: pudo entender otra cosa, resolver un problema adyacente, o arreglar el síntoma. El código sale limpio igual, porque escribir código limpio es lo que mejor hace.

¿Por dónde empezar a revisar la entrega de un agente de IA?

La pregunta más barata y más reveladora es "¿por qué cambió este archivo?". Un archivo que no esperabas en la lista es la señal más fiable de que la tarea se entendió de otra forma. Se responde en diez segundos y te ahorra leer trescientas líneas.

Después, la prueba que lo demuestra

Antes de leer la implementación, busca la prueba. Dos preguntas: ¿existe, y fallaría si la implementación estuviera mal? La segunda es la que importa. Una prueba que pasa con la implementación vacía es común en salida de agente de IA, porque se escribió para pasar, no para demostrar.

Solo entonces el código

Y busca una cosa concreta: lo que se asumió sin decirlo. Que la red responde, que la lista no viene vacía, que el usuario tiene permiso, que la fecha está en el huso correcto. Ahí es donde más falla la salida de agente, y es invisible en una lectura fluida.

¿Cómo revisar cuando tres agentes de IA trabajan en paralelo?

Cuando tres agentes de IA trabajan en paralelo, el historial se vuelve una trenza y leer commit a commit no cuenta la historia de nadie. Revisa un frente entero cada vez, preguntando "¿esta tarea está lista?", y solo después mira cómo interactúan los frentes.

Esa interacción es donde vive el defecto propio del paralelismo: cada frente está bien aislado y juntos discrepan. Ninguna revisión por frente lo detecta, y por eso ejecutar la suite completa sobre el resultado combinado antes de integrar no es opcional. Revisar es solo la mitad del problema, y la otra mitad tiene reglas propias: cómo integrar el trabajo de varios agentes de IA sin romper main cubre el lado de la integración, que sigue siendo serial aunque la escritura haya sido paralela.

¿Vale que un agente de IA revise a otro?

Corrección, 15 de agosto de 2026. Esta sección decía que sí, con una condición, que el agente revisor fuera de otra empresa. Estamos estrechando esa afirmación, porque nunca corrimos la comparación controlada que aislaría la marca. Lo que sí podemos defender es que el agente revisor corra en una instancia separada, sin nada del contexto de quien escribió, bajo la instrucción de cazar un defecto en vez de confirmar que el código está bien. Si un proveedor distinto le gana al mismo modelo con contexto limpio es una pregunta abierta, y lo decimos con la medición en ¿puede un agente de IA revisar el código de otro agente de IA?. Lo que no cambió: no sustituye tu revisión, la acorta.

Cómo no convertirte en el cuello de botella

Pide entregas más pequeñas. Una tarea grande produce una entrega grande, lenta de comprobar y difícil de rechazar cuando sale mal: acabas eligiendo entre aceptar un bloque enorme y rehacerlo todo. Tres frentes pequeños ganan a uno grande porque apruebas de forma incremental.