Tu compañero de IA podría ser más honesto que uno humano
Que un agente de IA exponga su propia incertidumbre no es una manía. Es un buen hábito de trabajo.
· Matt Senter

Veo constantemente a gente burlarse de las respuestas de «respuesta honesta» de Claude Code. Ya sabes de qué tipo: «Respuesta honesta: en realidad no verifiqué eso». «Respuesta honesta: tomé un atajo». «Respuesta honesta: la documentación está incompleta y me basé en la memoria».
Se ha convertido en un tópico y la gente comparte capturas de pantalla para reírse. Y, siendo justos, Claude puede pasarse. Tiene su gracia que una máquina confiese con dramatismo que se saltó un paso. Pero creo que nos estamos riendo de lo que no toca.
Imagina a un compañero diciendo lo mismo
Imagina que un empleado humano te diera ese nivel de detalle por voluntad propia: «Subí esto sin probarlo del todo». «Me salté el proceso habitual porque pensé que así iría más rápido». «Dije que estaba terminado, pero solo probé el camino feliz». «En realidad no estoy seguro de que esa suposición sea correcta». «Aquí corté por lo sano y probablemente debería volver a arreglarlo».
¿Con qué frecuencia ocurre eso sin que antes hayan acorralado a alguien? La mayoría de la gente no actúa de mala fe. Es humana. Estamos programados para protegernos, evitar la vergüenza y presentar nuestro trabajo de la mejor manera posible. Si algo sale a producción y parece funcionar, hay un fuerte incentivo para no mencionar cada atajo, duda o decisión discutible que hubo por el camino.
En el software en particular, apostaría a que hoy se ejecuta una cantidad enorme de código en producción porque alguien dobló una regla en silencio, se saltó una prueba, entendió mal un requisito o decidió que «suficientemente bueno» bastaba. Casi ninguna de esas historias queda documentada, salvo que algo acabe rompiéndose.
La frase no es lo importante
Así que cuando Claude Code dice «respuesta honesta: no verifiqué eso», mi reacción es cada vez más: bien. Ese es justo el comportamiento que quiero de un agente de IA. La frase en sí no vuelve verdadera por arte de magia la oración siguiente. Los sistemas de IA todavía pueden malinterpretar lo que hicieron, alucinar explicaciones o describir su propio comportamiento con una seguridad equivocada.
Lo valioso es la norma que hay detrás. Quiero que los agentes me digan qué verificaron, qué supusieron, qué omitieron, dónde tomaron atajos y cuánta confianza tienen en el resultado. Quiero que distingan entre «sé que esto funciona» y «creo que esto funciona». Quiero que admitan cuándo eligieron el camino más rápido en lugar del más seguro.
La transparencia es parte del trabajo
A medida que los agentes de IA asumen más trabajo real, esa transparencia operativa puede convertirse en una de sus mayores ventajas. Le da a la persona responsable del resultado una elección más clara: aceptar la contrapartida, pedir más verificación o detener el trabajo antes de que una suposición se convierta en un incidente.
Dedicamos mucho tiempo a preguntarnos si la IA puede comportarse más como un buen empleado humano. Quizá este sea un caso en el que los humanos deberíamos tomar nota de la IA. Un compañero de confianza no es alguien que nunca se equivoca. Es alguien que hace visible la incertidumbre cuando todavía hay tiempo de hacer algo al respecto.