⚠️ Traducción en desarrollo. Esta edición en español aún no incorpora las revisiones más recientes y puede contener pasajes desactualizados. La edición en inglés es la versión de referencia.

35  Gestionar varios agentes de IA

WarningEn desarrollo

Este capítulo forma parte de un libro en desarrollo activo y todavía no ha pasado por la revisión del autor. El contenido puede cambiar a medida que avanza la revisión.

Open In Colab

La decisión de investigación. Correr varios agentes de IA significa correr varios bucles a la vez. Decides cómo partir el trabajo en tareas acotadas, en qué orden corren esos bucles para que ningún error temprano se cuele aguas abajo, y qué paso de la cadena ningún bucle tiene permitido cerrar.

35.1 Por qué importa esta decisión

La decisión en juego: cuántos bucles de IA pones a correr sobre una pieza de tu trabajo, en qué orden, y qué paso mantienes fuera de todos ellos.

“Tráeme un borrador, no una pila de salidas de IA. Quiero saber qué parte tocó cada herramienta, qué le dijiste que hiciera y cómo lo comprobaste. Si no puedes decirme eso, no lo escribiste tú.” — tu directora de tesis, leyendo el borrador que estás por defender

A estas alturas, una sola asistente de IA puede redactar, citar, criticar y pulir de un tirón. La tentación es abrir cuatro a la vez y sentir cuatro veces más seguridad. No la tienes. Cuatro roles que leen el mismo borrador con las mismas instrucciones tienden a pasar por alto lo mismo y a coincidir en voz alta al respecto. Y cada uno de esos roles no es un prompt. Es un bucle, corriendo hasta que tú o él deciden parar. Cuatro bucles a la vez son cuatro veces la salida y, sin gestión, cuatro veces el trabajo sin supervisar. La directora de arriba no quiere un coro más ruidoso. Quiere ver que partiste el trabajo en piezas, pusiste esas piezas en un orden sensato y seguiste siendo la única persona que decidió qué afirma el borrador. Este capítulo te da esa capacidad de gestión.

35.2 El concepto

Empieza por la unidad que en realidad estás gestionando. El bucle de IA es el ciclo que vienes corriendo desde el principio de este libro: escribes el prompt, lees la salida, la interrogas, afinas el pedido y lo corres otra vez. Un bucle, una tarea, una persona mirando. Las herramientas agénticas son sistemas de IA que corren ese bucle solos, decidiendo su propio siguiente paso y llamando sus propias herramientas entre tus turnos. Ejemplo: pides que se revisen las citas y la herramienta busca, lee, vuelve a revisar y corrige a lo largo de varios turnos antes de volver a ti. Es más rápido, y cada turno que no leíste es un turno que no supervisaste.

Así que la verdadera pregunta de gestión no es cuántos prompts escribes. Es cuántos bucles tienes corriendo, qué tiene permitido tocar cada uno y dónde se pasan el trabajo entre sí. Orquestas bucles, no prompts.

El movimiento que convierte una multitud de bucles en un flujo de trabajo que puedes defender es la descomposición de tareas: partir un trabajo grande en subtareas más pequeñas, cada una con una sola dueña clara. Ejemplo: en vez de pedirle a una herramienta que “mejore mi borrador”, partes el trabajo en revisar el diseño, revisar las citas y apretar la prosa. Cada pieza tiene ahora un aprobado o reprobado que puedes juzgar.

Cada pieza se vuelve un rol acotado: una tarea de IA lo bastante estrecha como para enunciarla en una oración y comprobarla en una pasada. Ejemplo: “señala cada oración de mi sección de resultados que afirme más de lo que mi muestra puede sostener”. Un rol acotado tiene una línea de meta clara. “Hazlo mejor” no la tiene. Esa línea de meta es lo que hace seguro correr el bucle del rol: el bucle se detiene cuando la tarea está hecha, y desde fuera puedes notar si lo está.

La columna vertebral que mantiene honestos a los roles es el par trabajador-crítico: un rol produce algo y un segundo rol, aparte, ataca lo que el primero produjo. Ejemplo: un trabajador redacta tu párrafo de limitaciones y después un crítico caza la limitación que el trabajador dejó fuera. Un trabajador solo confía en su propia calidad, que es exactamente el punto ciego que no puede ver desde adentro.

Conectar los roles significa decidir qué espera a qué. Una dependencia es un orden obligatorio entre dos subtareas, donde una necesita la salida de la otra antes de poder empezar. Ejemplo: un crítico no puede atacar un borrador que el trabajador todavía no ha escrito. Los roles sin dependencia entre ellos corren al mismo tiempo. Los roles unidos por una corren en orden.

La cadena de dependencias que no puedes acortar es la ruta crítica: la secuencia más larga de pasos que deben seguirse uno tras otro en tu flujo de trabajo. Ejemplo: el trabajador redacta, después el crítico ataca, después tú integras son tres pasos que no pueden colapsar en menos. Esa cadena fija el número mínimo de rondas que toma tu flujo. Leer la ruta crítica en tu propio diseño, en vez de adivinarla, es la habilidad que este capítulo entrena. Cuéntala en bucles, no en mensajes. Un solo rol puede tomar cuatro turnos de prompts para terminar su única tarea, y sigue ocupando un nodo de la ruta.

35.3 Un ejemplo resuelto

Estás terminando el texto de un pequeño estudio de salud: si una caminata de diez minutos después del almuerzo se asocia con una frecuencia cardíaca en reposo más baja por la tarde entre las personas que viven en tu piso de la residencia. Tienes un borrador y cuatro roles de IA esperando.

Parte. Divides la revisión en roles acotados. Un revisor de claridad comprueba si cada oración se lee con sencillez. Un metodólogo comprueba si “se asoció con” es la palabra honesta para lo que tus datos pueden mostrar. Un verificador de citas confirma que los dos estudios de frecuencia cardíaca que citas son reales y dicen lo que afirmas. Un editor aprieta la prosa. Cada rol es dueño de una tarea de una oración.

Conecta. El trabajador redacta tu párrafo de limitaciones. Los tres críticos pueden leer ese borrador en el mismo momento, porque ninguno necesita la salida de otro. Eso son tres bucles corriendo en paralelo. Cada uno toma los turnos que necesite: el verificador de citas probablemente corre cuatro o cinco, buscando, sin encontrar uno de tus estudios y volviendo para decírtelo. Después tú integras sus notas, y el editor aprieta lo que sobrevivió. Sigue las flechas: del trabajador a un crítico es una, del crítico a ti son dos, de ti al editor son tres. Tu ruta crítica tiene tres flechas de profundidad, y corre tres bucles en su punto más ancho.

Mantén un paso humano. El paso de integrar es tuyo, y es el único nodo sin bucle conectado. Cuando el metodólogo dice que tu resultado de caminata y frecuencia cardíaca es solo una asociación y el revisor de claridad amó la oración que la llamaba efecto, ningún rol zanja ese choque. Tú sí. La decisión sobre qué afirma el texto nunca entra al flujo de trabajo como una tarea delegada.

Las herramientas redactaron, señalaron y pulieron. Tú partiste el trabajo, fijaste el orden, decidiste cuándo cada bucle había corrido lo suficiente, y la afirmación que lleva tu nombre siguió siendo tuya.

35.4 El laboratorio en Colab

Este capítulo tiene su propio cuaderno de acompañamiento: ábrelo en Colab con la insignia de arriba. El cuaderno reúne los prompts y el código del capítulo y termina con el espacio de trabajo Ahora te toca a ti, para que completes el paso del capítulo en tu proyecto sin salir de Colab. El laboratorio de aula completo detrás de este capítulo es el cuaderno del curso nb16 — Managing multiple AI agents + the final defense (gestionar varios agentes de IA y la defensa final) (abrir en Colab), parte del curso de acompañamiento presentado en el apéndice Para docentes. Ahí construyes el flujo trabajador-crítico como un grafo dirigido, lees su profundidad de ruta crítica y su ancho paralelo directo del código, y ves la ruta crecer una ronda en el momento en que haces que un crítico espere a otro crítico. Después descompones tu propio borrador en roles acotados y defiendes el cableado que elegiste.

35.5 Prompts de IA recomendados

Comprométete primero con tu propia respuesta y después delega. Cada prompt de abajo abre un bucle que tú supervisas, y uno de ellos es un bucle sobre tus otros bucles. Lee lo que vuelve, empuja contra la parte débil, córrelo otra vez. Cada prompt es una tarea verificable, no una petición de veredicto.

Descompón y devuelve el paso humano.

I am splitting the review of my health write-up into scoped AI roles. Here are my
section headings and one line on each: [paste them]. Propose a table with one row
per role: the role's one-sentence scoped task, the draft or input it needs, whether
it can run in parallel or must wait on another role, and the single decision it must
hand back to me.

Después de ejecutarlo, verifica: comprueba que cada celda de “devuélvemelo a mí” nombra una decisión de no delegar que es real, no una inventada para parecer prudente. Contrarresta la ilusión de exhaustividad (una tabla de roles ordenada que se lee exhaustiva mientras omite la comprobación que importa).

Confirma que el cableado no deja pasar ningún error temprano.

Here is my proposed workflow as a list of "role A feeds role B" arrows: [paste them].
For each role, tell me exactly what input it depends on, and name any role I have
scheduled to start before the input it needs actually exists.

Después de ejecutarlo, verifica: dibuja por tu cuenta las flechas y sigue si el insumo de cada rol existe cuando ese rol empieza. Contrarresta el método plausible pero equivocado (un cableado confiado que deja correr un rol antes de que su insumo esté listo).

Hazle red team (revisión adversaria) a la descomposición.

Act as a hostile reviewer of my AI workflow, not of my draft. Name every place an
early mistake in one role could flow downstream unchecked, and every role whose job
overlaps another so much that it adds no independent check. Do not rewrite my plan.

Después de ejecutarlo, verifica: si solo elogia tu plan, empuja de vuelta y exige la peor falla de cableado. Contrarresta el acuerdo complaciente (elogio que revisa tu ego, no tu flujo de trabajo).

ImportantNo delegues

La partición y el orden pueden apoyarse en una herramienta, pero tres decisiones se quedan solo contigo. Tú decides qué tareas valen su propio bucle y cuáles solo multiplican una salida que no puedes supervisar. Tú decides el orden, para que ningún rol zanje una pregunta que un rol aguas arriba debió responder primero. Y mantienes el paso de integrar humano: cuando dos roles no coinciden sobre qué afirma tu borrador, tomas esa decisión con tus propias palabras. Un flujo de trabajo que entrega la afirmación a una herramienta no es un flujo que puedas defender. La regla escala con el número de bucles en vez de doblarse ante él. Más agentes no significa mando más flojo; significa la misma disciplina de mando, repetida.

35.6 Un caso de falla de la IA

Le pides a una herramienta que diseñe tu flujo de trabajo multiagente, y devuelve un plan confiado y bien formateado: corre el trabajador, el metodólogo, el escéptico y el editor todos en paralelo para “ahorrar rondas”. El plan corre en tu cabeza sin tropiezos. Aquí está la trampa. El editor y el escéptico no tienen nada que leer todavía, porque el trabajador no ha redactado nada. La herramienta programó tres roles para empezar antes de que exista el insumo del que dependen, y lo vistió de eficiencia. Entrega ese plan a una herramienta agéntica que lo ejecuta por ti y la falla se vuelve más silenciosa, no más ruidosa: tres bucles corren sobre un borrador vacío y devuelven tres revisiones confiadas de nada.

Lo detectas dibujando las flechas y haciendo una pregunta en cada rol: ¿existe el insumo de este rol en el momento en que empieza? El insumo del editor es el borrador integrado, que no existe hasta el final, así que “editor en paralelo con el trabajador” es imposible. Redibujado con honestidad, el plan es una ruta crítica de tres flechas de profundidad, no de una. Un plan verde y ordenado no es un plan válido. Revisas las dependencias, no la seguridad con que se presentan.

35.7 Ahora te toca a ti

Tu proyecto ya tiene una nota de investigación y una cápsula reutilizable; este paso monta el pequeño equipo de IA que te ayudará a revisarlas, sin entregarle al equipo tu criterio.

  1. Elige una sección real de tu proyecto para revisar: tus métodos, tus resultados o tus limitaciones. Todo lo de abajo aplica solo a esa sección.
  2. Monta tres bucles, cada uno con una tarea de una oración que podrías calificar. Un escritor que redacta o reescribe. Un escéptico que ataca lo que el escritor produjo y busca la afirmación que se estira más allá de tu evidencia. Un auditor que revisa tus números, tus citas y si cada oración corresponde a una salida que de verdad tienes.
  3. Conéctalos. Anota qué bucles pueden correr al mismo tiempo y cuáles deben esperar la salida de otro, y después traza la cadena más larga de pasos obligatorios. Esa cadena es el número mínimo de rondas que tomará tu revisión.
  4. Nombra el único nodo que mantienes humano, el paso donde el trabajo de los bucles se vuelve tu afirmación, y anota por qué ningún rol tiene permitido tomarlo.
  5. Corre la ronda. Para cada bucle, registra cuántos turnos tomó, qué rechazaste y qué conservaste. Un bucle cuya salida aceptaste sin leer es un bucle que no gestionaste.
  6. Registra cada bucle en tu AI Research Ledger (registro de investigación con IA) y verifica al menos una salida con un método nombrado de la Guía de Verificación. Un revisor de IA puede hacer la comprobación contigo; la decisión de aceptar o rechazar sigue siendo tuya.