Te lo encargo
Hace un par de años fui vocal del kínder de mi hijo y le delegué la minuta de la junta a la IA: mandé al grupo un acuerdo que nunca existió: que iríamos a un concierto de Maná. La minuta que otra mamá tomó a mano puso la evidencia sobre la mesa. La ciencia reciente le puso número al resto: delegar no falla en el delegado sino en el que encarga, y la honestidad cae de unos 95 de cada cien haciéndolo uno mismo a unos 15 encargándolo por objetivo.
Sala de JuntasDato Duro
Hace un par de años me tocó ser vocal del grupo de mi hijo, que entraba a kínder 1. El vocal es el papá o la mamá que hace de puente entre la escuela y las familias: la junta mensual, los avisos, los permisos. Mi hijo apenas se integraba y me pareció un momento lindo para estar cerca. Y traía un plan bajo la manga: delegarle a la IA las minutas de la junta de padres de familia. Si algo hace bien esta tecnología es transcribir conversaciones; hoy es de sus usos más cotidianos, y la junta mensual parecía el lugar perfecto para estrenarlo.
La junta que me tocó fue la grande: la organización del evento deportivo anual del colegio, donde participan varios campus y hay que coordinar de todo. Si nunca has estado en una, te comparto lo que aprendí: ahí se viven discrepancias, debates álgidos e intercambios de ideas que hacen ver a muchas salas de juntas como juegos de niños. Cuando preguntaron quién se ofrecía a tomar las notas, levanté la mano.
Grabé la sesión con mi teléfono. Era el 18 de octubre de 2024 y la transcripción automática en el propio teléfono apenas empezaba, pero para eso era el plan: al terminar le pedí la minuta a la IA y la mandé al grupo de WhatsApp de los vocales, tal como salió.
La respuesta llegó al mismo grupo, de las mamás: ¿en qué momento se acordó que iríamos a un concierto de Maná? Otra mamá había tomado la minuta a mano, y al poner las dos lado a lado el veredicto fue rápido: en esa junta no se discutió ningún concierto, y menos de Maná. Mi sistema de grabación lo alucinó: rellenó un hueco con algo que sonaba a evento grande y nunca pasó. Visto desde hoy casi parece profecía, porque este junio Maná terminó abriendo la inauguración del Mundial en el Azteca. Pero en aquella junta de octubre de 2024, el dato era simplemente falso.
Esa minuta me costó doble: la credibilidad como toma-notas y la credibilidad de la tecnología con la que llegué presumiendo plan. Y lo incómodo es que la máquina falló como fallan las máquinas, un porcentaje de las veces; el que falló completo fui yo. Solté la tarea y, junto con la tarea, solté la lectura, el cotejo y la responsabilidad. Nadie me pidió mandar la minuta sin leerla. Ese paso lo puse yo solito.
De eso viene la pieza de esta semana: en los últimos doce meses la ciencia le puso números a ese fallo, y el hallazgo apunta menos al modelo que al que encarga.
El encargo que se fue solo
el encargo de unos 95 honestos de cada cien haciéndolo uno mismo a unos 15 encargándolo por objetivo, y nadie pidió la trampa en voz alta →
Empiezo por el que trae el sello más difícil de conseguir: Nature, revisión de pares, septiembre pasado. Trece experimentos, más de 8,000 participantes, y una idea simple: a la misma persona, en la misma tarea con incentivo para mentir (reportar tiradas de dado que pagan, declarar ingresos que se gravan), le cambian una sola cosa: la forma de encargarle el trabajo a la máquina.
Lo que encontraron es una cuesta abajo. Haciendo la tarea uno mismo, alrededor de 95 de cada cien reportan honesto. Delegando con reglas explícitas, del tipo “si pasa esto, haz aquello”, bajan a unos 75. Delegando mediante la elección de datos de ejemplo, a unos 50. Y cuando el encargo se reduce a un objetivo, una perilla que se gira de “maximiza la exactitud” a “maximiza la ganancia”, quedan alrededor de 15 honestos de cada cien. De 95 a 15: unos ochenta puntos que se pierden sin que nadie haya pedido la trampa en voz alta. La perilla lo dijo por ellos.
El detalle que cambia la lectura es a quién se le pedía. Las personas no le encargaron más trampas a la máquina que a un agente humano; lo que se abrió fue el cumplimiento. El agente humano se niega con frecuencia a ejecutar una instrucción tramposa. La máquina obedece: en la tarea del dado, los cuatro modelos probados cumplieron la petición de trampa completa en la gran mayoría de los casos (más de 82%); en la de impuestos, en más de 58%. Los modelos probados eran de la generación pasada, con corridas de principios de 2025; los sistemas cambian rápido, la mecánica del encargo no.
Y hay un dato final que me reconcilió con mi junta: después de delegar, 74% de los participantes dijo que preferiría hacer la tarea él mismo. Los autores rematan con una recomendación de diseño que suena a regla de salón: que la opción de no delegar exista siempre, y de preferencia sea la que viene marcada por default. Traducido a una operación: que soltar sea la opción que se justifica, no la que viene puesta.
Mi encargo a la grabadora nunca fue “apunta lo que se diga” sino “hazme la minuta”: un objetivo, no una regla. Y los objetivos, ya está medido, son la forma de encargar en la que más cosas pasan sin que nadie las pida.
La minuta de la otra mamá
la otra minuta 70,000 solicitantes sorteados entre reclutador humano y agente de voz, 12% más ofertas para los de la máquina, y la decisión nunca salió de manos humanas →
A mí no me exhibió un auditor ni un sistema de control. Me exhibió una mamá con pluma, que hizo lo que yo había dejado de hacer: estar presente en su propia nota. Y el caso mejor documentado del año de una delegación que salió bien se parece más a ella que a mi grabadora.
Un experimento de campo siguió a 70,000 solicitantes de empleo asignados al azar: a unos los entrevistó un reclutador humano; a otros, un agente de voz de IA. La línea que importa está en el diseño, antes que en el resultado: en ambas condiciones, las conversaciones las evalúan reclutadores humanos y las decisiones de contratación las toman personas. Se delegó la entrevista; la decisión, jamás.
Con esa línea trazada, delegar funcionó: los candidatos que pasaron por la máquina resultaron 12% más propensos a recibir una oferta, con más contrataciones concretadas y sin caída en la productividad de los contratados. La explicación de los autores no es que la IA entreviste mejor, sino que entrevista parejo: conversaciones más estructuradas y consistentes, que le entregan al humano que decide expedientes comparables, en lugar de expedientes levantados cada uno con un humor distinto. La ganancia vino menos de un mejor criterio que de mejores insumos para el criterio de siempre.
Es un estudio académico de julio (todavía sin revisión de pares), con 131 reclutadores y 41 cuentas de clientes, entre ellas empresas del Fortune 500. Y trae el dato más contraintuitivo del expediente: cuando a los candidatos les dieron a elegir entrevistador, 78% escogió a la máquina.
El resultado bueno dependió por completo de una decisión tomada antes de la primera entrevista: la línea entre lo que se suelta y lo que se firma. La mamá de la minuta manual era esa línea en mi junta, el criterio que nunca salió del circuito. Si yo hubiera leído la minuta antes de mandarla, la grabadora habría quedado en lo que era: una taquígrafa rapidísima con imaginación ocasional.
El reporte que sonaba seguro
la vigilancia entre jefes que ya conviven con agentes de IA, la etiqueta “empleado de IA” afloja la supervisión: 18% menos errores cazados, y con una persona la vigilancia no cae →
Y ni modo de echarle la culpa a la novatez, porque tengo un segundo caso y es de oficina. Un reporte semanal que le encargué a la IA llegó un día mostrando una caída de casi 40% en la cuenta más grande. Venía redactado con la misma seguridad de todas las semanas; ni una nota de duda. La alarma no la disparó el sistema: la disparó la incredulidad, porque el número no cuadraba con nada de lo que sabíamos del negocio. Escarbando encontramos la causa: la fuente de los datos había cambiado la manera de catalogar el portafolio. Los totales seguían cuadrando; los detalles, ya no. Lo único intacto era el tono de seguridad. El sistema nunca dudó; los que dudamos, tarde, fuimos nosotros.
Un experimento de este verano, con participantes asignados al azar y el diseño registrado por adelantado, midió por qué pasa eso. A cientos de gerentes les dieron los mismos documentos con errores sembrados y veinte minutos para revisarlos; lo único que cambiaba era la etiqueta del autor: una herramienta de IA, un empleado humano, o un “empleado de IA” con nombre propio y asiento en el organigrama. Entre los gerentes cuyas empresas ya tienen agentes de IA en el organigrama, la etiqueta de empleado digital hizo su trabajo silencioso: la responsabilidad que sentían propia bajó nueve puntos porcentuales, cazaron 18% menos errores sembrados y mandaron el documento a otro revisor 22 puntos porcentuales más seguido. El espejo es lo que más me detuvo: cuando les dijeron que el trabajo era de una persona, la vigilancia no cayó. Al empleado nuevo se le revisa; al empleado digital se le cree. El efecto es de ese subgrupo que ya convive con agentes, no un promedio general; y tres de los cuatro autores trabajan en una consultora que vende transformación con IA, aunque el diseño quedó registrado antes de conocer un solo resultado.
¿Y cuánto de esto ya está pasando de verdad? Menos de lo que el ruido sugiere, y ahí hay una buena noticia. Una encuesta con muestra representativa de los trabajadores de Estados Unidos encontró en julio que 20% ya deja en manos de la IA casi toda o toda una tarea que antes le daba a una persona; usar la herramienta es común, soltarle el encargo completo sigue siendo raro. Y cuando un equipo de investigación clasificó 1.53 millones de peticiones reales a los chatbots (registros donados por sus usuarios en Estados Unidos e India, levantados entre agosto y octubre de 2025), el terreno del dinero mostró una escalera con el último escalón vacío: de cada mil conversaciones de dinero, solo tres terminan con la máquina ejecutando algo. La puerta de soltar de verdad casi nadie la ha cruzado todavía. Lo que ya sabemos, con número, es qué le pasa al que la cruza sin leer la minuta.
Mi reporte del 40% cabe completo en ese cuadro: el encargo llevaba tanto tiempo saliendo bien que dejó de tener dueño. Nadie vigilaba la fuente porque vigilarla no era tarea de nadie. La cadencia de verificación no se cayó: nunca la definimos, porque el encargo se hizo una vez y se dejó corriendo.
El “empleado de IA” en el organigrama y la vigilancia del que delega (Wiles, Hsu, Bedard y Kropp, experimento preregistrado) · Uno de cada cinco ya delega a la IA una tarea que le daba a una persona (Epoch AI con panel de Ipsos) · 1.53 millones de peticiones reales: informar, influir y casi nunca ejecutar (Stripe Partners, consultoría de investigación sin relación con la empresa de pagos; arXiv, preprint)
La siguiente junta
el lunes
El mismo laboratorio del estudio de Nature probó también el remedio, y no es el que yo pensé originalmente. Explicarle al delegador cómo funciona la máquina, qué entrada suya produce qué comportamiento, no cambió nada: los participantes leyeron la explicación, la entendieron y siguieron encargando trampa. Lo que sí movió la aguja fue cambiarle el nombre a la perilla: cuando “maximizar ganancia” pasó a llamarse por su efecto real, “maximizar trampa”, la deshonestidad bajó de forma sustancial. El número fino vive en una tabla que no pude auditar y no te lo voy a inventar; el mecanismo está publicado en actas con revisión, del mismo grupo. Para frenar el mal uso no hizo falta un curso de mecánica sino una etiqueta honesta.
El tip de la semana para poner en práctica el próximo lunes cuesta cero y es algo que podrían hacer los niños de kínder: ponles nombre de verdad a los encargos que ya corren solos en tu operación. Lee cómo se llaman hoy: “optimizar cobranza”, “maximizar conversión”, “reducir tiempo de atención”. Y pregúntate cómo se llamarían si los nombrara la mamá de la minuta manual. Si el nombre honesto te incomoda, el encargo está mal definido; si además nadie tiene calendario para dudar de él, ya conociste mi reporte del 40%. Y a cada encargo que renombres, déjale un dueño y una fecha para dudar de él.
A este fallo el libro le dedica el capítulo 3 completo: el fallo en delegar, la distancia entre soltar una tarea y soltar el criterio. Y me da gusto escribir por primera vez que ya no tienes que esperarlo: desde esta semana La Pieza Pendiente está a la venta en papel; las tiendas están aquí.
De la junta del concierto me quedó una regla: la grabadora graba, y la minuta la firma el vocal. La pregunta para el lunes va por ahí: de todas las minutas que hoy circulan en tu operación con tu nombre encima, ¿cuántas mandaste sin leer? Y cuando las encargaste, ¿qué encargaste exactamente: que apuntara, o que quedara bien? Lo que distingue al que encarga bien es poder delegar con confianza lo que hoy solo se puede delegar con esperanza.
Esa fue la pieza de esta semana.
— JP
27 de 27 piezas
Leíste todas.
Pocas personas llegan hasta aquí, y me gustaría saber quién eres. Escríbeme con el asunto «Las 27» y te contesto yo.
Escríbeme— JP
La Pieza · newsletter semanal
Si esta pieza te sirvió, la próxima llega el martes a tu correo: un ensayo breve sobre IA y liderazgo, cinco minutos de lectura, sin tecnicismos y sin hype.
Un correo por semana · Sin spam · Baja cuando quieras
Clic. La conexión está hecha.
Suscripción confirmada. La próxima edición llega a tu correo el martes.