Thumbnail del episodio: Ponle límites a tu IA antes de delegarle todo
Episodio 24 50:27

Ponle límites a tu IA antes de delegarle todo

Rodrigo armó su sitio nuevo con un agente de diseño y descubrió que el trabajo está en dibujar los límites antes de delegar. Cristian migró un sistema legacy con IA. Además: los Dots de OpenAI, Gemini 4 Argon y Opus 5.5.

Temas tratados

Ponerle límites a un agente: skills, reglas, conectores y un kit de diseño Cómo Rodrigo armó un agente de diseño web para su sitio nuevo El semáforo de estados para que la IA no se salte etapas Migrar código legacy con IA y la deuda técnica que nadie arregló El slash goal de Codex y el autoresearch de Karpathy

Capítulos del episodio

18 saltos · abre en YouTube

  1. 00:00 Sin Diego: Rojo y Verde solos
  2. 00:57 El captcha que faltaba y los bots en el newsletter
  3. 02:35 Migrar código legacy con IA y la mediocridad en TI
  4. 07:45 Codex y el slash goal: un objetivo grande en loop
  5. 09:35 Seis años de deuda técnica que nadie arregló
  6. 11:41 Rodrigo arma su sitio con un agente de diseño
  7. 14:33 Por qué la IA no hace dos veces lo mismo
  8. 17:49 Storytelling, manual estratégico y el nacimiento de Edna
  9. 20:18 El semáforo de estados para que no se salte etapas
  10. 23:19 Limitar la cancha: procesos, reglas y skills
  11. 25:21 Dejar de ser gratis y sacar a 1.700 miembros
  12. 29:58 Noticias: Opus 5.5, GPT-6 y el DevDay de OpenAI
  13. 31:09 Los Dots: el agente persistente dentro de ChatGPT
  14. 37:00 MiniMax y el fin de la bolsa de tokens
  15. 38:02 ChatGPT Spaces y una aplicación que se volvió compleja
  16. 39:50 Gemini 4 Argon pasó sin pena ni gloria
  17. 42:00 Opus 5.5 contra Astra armando el mismo sitio
  18. 43:53 Recomendaciones: prueben, gasten tokens con criterio y ordenen su información

Rodrigo pasó el fin de semana armando su sitio web nuevo con IA. Lo que más tiempo le tomó no fue el diseño, fue decidir dónde podía jugar el agente: qué herramientas usar, qué reglas seguir y qué no inventar. Después de eso, todo salió a la primera. Cristian vivió lo contrario: le tocó migrar un sistema que varios equipos de TI pagados dejaron caer durante seis años. En un episodio sin Diego, ocupado en una licitación, también repasan el DevDay de OpenAI, Gemini 4 Argon y por qué Opus 5.5 los dejó en shock.

Lo que vas a aprender

  • Cómo armar un agente para una tarea concreta, con skills, conectores y reglas antes de pedirle nada
  • Por qué la IA se salta etapas en procesos largos y cómo evitarlo con un archivo de estado
  • Qué cambia cuando una comunidad deja de ser gratis
  • Qué son los Dots de OpenAI y en qué se diferencian de un agente propio como Hermes
  • Cómo gastar tokens sin culpa, pero con criterio

¿Por qué la IA no hace dos veces lo mismo?

Rodrigo venía trabajando su marca a mano, con lo que él llama poco talento gráfico. Esta vez armó el sistema de diseño en Claude Design, con mucho feedback humano, y lo bautizó Órbita. El problema llegó al llevarlo al sitio web: no era solo aplicar colores y fuentes, había que rediseñar y agregar contenido nuevo.

La pista se la dio una entrevista que vio ese viernes: Matt Pocock conversando con Lauren Tan, conocida como Poteto, que construye Grok Bot en SpaceXAI. Hablaban de cómo desarrollar a escala con IA, y la idea que se llevó Rodrigo fue que, para darle libertad a un agente, primero hay que ponerle buenos límites.

“Por detrás, la IA generativa es igual que las personas. Si le pides a alguien que haga algo dos veces, lo va a hacer similar, no igual, a menos que tenga el proceso súper claro y establecido.” — Rodrigo Rojo

Su comparación es la hamburguesa de McDonald’s: siempre sale igual porque todo está armado. Para un agente, eso son las skills, los conectores y la documentación con reglas claras. Cristian ya lo había hecho cuando armaron el sitio del podcast: lo primero que le pidió a su agente fue una página con el sistema de diseño, para que el resultado fuera repetible.

¿Cómo se arma un agente de diseño web?

Antes de tocar el sitio, Rodrigo definió qué tenía que saber el agente. Fue sumando piezas:

  • Una skill de la plataforma. Su sitio está en Ghost, así que le pasó toda la documentación y le pidió que se armara una skill para trabajar con esa herramienta.
  • Una skill del sistema de diseño. Convirtió Órbita en algo que cualquiera de sus agentes, Claude u otro, pudiera usar.
  • Un kit de recursos. Una carpeta en la nube con el logo y las imágenes, a la que apunta la skill por si le falta algo.
  • Skills de validación. Buscó con IA las mejores skills de SEO técnico y de verificación en escritorio, tablet y celular, y se inspiró en el paquete de skills de la entrevista de Poteto.
  • Una skill de storytelling. Le pidió a la IA que investigara el método de Pía Cárdenas, experta en comunicación efectiva, y un libro sobre el tema, para escribir con técnicas como problema-solución o AIDA.
  • Su manual estratégico. Un documento que había armado antes con Cowork: quién es, qué vende, a quién le habla.

Cristian sumó un dato: con la API de PageSpeed Insights de Google, el agente puede revisar la velocidad del sitio sin que tú entres.

Con todo eso cargado nació Edna, bautizada así por Edna Moda, la de Los Increíbles, con la ayuda de Lily, que le dio feedback en cada paso. Rodrigo invirtió mucho tiempo en esa parte inicial. Después, todo salió perfecto, y en la última validación técnica el agente encontró un enlace roto que nadie había visto.

“Lo que acabas de construir es una base robusta para seguir construyendo encima. Lo otro es crear sobre palitos de fósforo, que después no escala.” — Cristian Tala

¿Cómo evitar que la IA se salte etapas?

Cristian pasó por algo parecido con un agente de UX que bajó de un repositorio abierto, y tiene una recomendación: cuando un proceso tiene demasiados pasos, la IA se los va a saltar, aunque le digas uno, dos, tres, cuatro. La solución es un manejo de estados. El más sencillo es un semáforo: la IA va guardando un archivo con la etapa en la que está, y así sabe en cuál seguir.

Rodrigo lo matiza. Los agentes tipo Cowork ya arman una lista de tareas y avanzan en loop, pero si no le das las etapas, la llena como interpreta lo que le pediste. En su caso no lo dejó autónomo: él condujo. Primero solo diseño, después storytelling, validando cada etapa con su criterio. Si lo hubiera dejado solo, el semáforo habría sido necesario.

La lección vale para cualquier proceso, sea diseño web, una campaña o el sistema de respaldo de una empresa.

“Para que la IA trabaje con tu estilo, con tus definiciones, con tu proceso, primero tienes que enseñárselo.” — Rodrigo Rojo

Limitar la cancha no es amarrar al agente, aclara Rodrigo: es decirle estos son los conectores, estas son las tres skills, no inventes esto. Y avisa de un riesgo al complejizar el sistema: instaló una skill que competía con la suya. Cristian agrega que las skills se dejan en el repositorio donde se usan, no de forma global, para ver dónde funcionan mejor.

¿La IA multiplica la mediocridad?

Cristian llegó con rabia. Le tocó ayudar a una empresa con un CRM y ERP propio, mantenido durante años por empresas de desarrollo que cobran mucho al mes. Por coincidencia entró a la cuenta de Amazon y vio que la máquina se iba a apagar en seis días: era un Ubuntu de 2016 sobre una imagen que Amazon ya había dado de baja, y la base de datos estaba caducada desde el 31 de julio.

Pensó que sería fácil: respaldar, migrar a contenedores y listo. No lo fue. En seis años nadie respaldó el código, nadie siguió el framework instalado, había scripts metidos directo en los controladores, y la base de datos que las auditorías daban por cerrada estaba abierta. Tuvo que armar un contenedor con las tecnologías antiguas porque las nuevas no corrían.

Rodrigo le recordó su regla: si eres bueno, la IA te hace muy bueno, y si eres malo, te hace malo.

“Cualquier número multiplicado por cero sigue siendo cero.” — Rodrigo Rojo

Cristian partió con OpenCode y GPT-6 Sol, que encontró muy bueno en calidad pero lento esos días, y el jueves pasó a la versión 6.1. Después se cambió a Codex para usar el slash goal, que OpenCode no tiene. Rodrigo explica la idea, inspirada en el autoresearch de Andrej Karpathy: le pones un objetivo y una métrica, y el agente trabaja en loop varios turnos para acercarse a ella. Cristian advierte que el objetivo tiene que ser medible, o queda dando vueltas.

“Hacer las cosas bien nunca ha sido difícil, especialmente si tú cobras por hacerlas bien.” — Cristian Tala

Su otro error de la semana fue propio: su sitio personal no tenía captcha, un bot llenó su newsletter de cuentas falsas, los correos dejaron de salir y el costo de envío subió. Su agente implementó el captcha de Cloudflare en cinco minutos. La lección: el blog personal merece el mismo cuidado que cualquier otro sitio.

¿Qué pasa cuando una comunidad deja de ser gratis?

Cristian enseña a usar IA para manejar negocios, incluso de una sola persona. Lo hacía gratis y la gente no participaba. Se aburrió, empezó a cobrar barato y sacó a 1.700 personas que no habían interactuado en meses. Los que entraron cuando era gratis lo siguen siendo. En vez de recibir críticas, quienes se quedaron empezaron a participar como nunca.

Rodrigo lo explica con tres niveles de participación: los consumidores, que miran; los contribuidores, que comentan y comparten; y los creadores, un porcentaje mucho más chico. Cristian sacó la capa de abajo. Cita a DHH, de 37signals, que dice que en el código abierto son “los dadores de regalos”: lo gratis hace que la gente pierda la noción de cuánto vale. Y suma el efecto terremoto: cuando algo se sacude, la gente sale y se ve las caras, y quien valora el espacio vuelve a participar. Cristian lo confirma con otro caso: los plugins que sostienen Ecosistema Startup son gratis y están en su repositorio, y no cree que nadie los use.

¿Qué trajo el DevDay de OpenAI?

Las semanas anteriores llegaron Claude Opus 5.5, otra vez número uno en casi todos los rankings, y al día siguiente GPT-6 Sol y Luna. Después vino el DevDay 2026: GPT-6.1 Sol, cambios en los planes, con menos uso en el de US$200 y uno nuevo de US$500 que, según Rodrigo, corre sobre tecnología de Cerebras con una velocidad brutal.

Para Rodrigo, lo más relevante son los Dots, la respuesta de OpenAI a Hermes y OpenClaw dentro de la aplicación:

  • Le pones nombre, cara y personalidad, y trabaja 24/7 con su propio computador
  • Se conecta a tus servicios y te escribe de forma proactiva al menos una vez al día
  • Con permiso, accede a tu computador desde la aplicación de escritorio
  • Puedes hablarle por voz, como una llamada, o por Slack
  • Trabaja con Codex por detrás
  • La conversación no gasta tu uso; las tareas que ejecuta, sí

Cristian lo encuentra lógico: él ya tenía un bot conversacional con un modelo Qwen que derivaba a uno más potente según la tarea. El problema es que los Dots partieron en los planes de US$200. Se suman a una categoría que crece: Grok Bot, Muse de Meta, por ahora en Estados Unidos y Canadá, y Cue, de Manus, que lanzó el suyo tras separarse de Meta cuando China bloqueó la compra.

OpenAI también presentó ChatGPT Spaces, un lienzo donde juntas imágenes, documentos, presentaciones y tablas, y donde tu Dot puede trabajar en paralelo. El costo es una aplicación que volvió a complicarse: la barra lateral se llenó de secciones y el chat no tiene todos los modelos, para elegirlos hay que ir a Work. Rodrigo espera que octubre sea el mes de ordenarla.

Del lado chino, salió MiniMax M3.1, pero Cristian no alcanzó a probarlo: su suscripción se cayó por un problema con la tarjeta y la pantalla para renovarla ya no existe. Rodrigo extraña la bolsa de tokens que se recargaba cada cinco horas, ideal para agentes. Cristian lo resume: alguien se dio cuenta de que estaban dejando plata sobre la mesa.

¿Por qué nadie habla de Gemini 4 Argon?

Google anunció Gemini 4 Argon, y según su tarjeta es mejor que Fable y que GPT en todo. Nadie lo pescó. Cristian vio el anuncio y ni pensó en probarlo. Tampoco se puede: por ahora lo usan socios de seguridad e internamente. Rodrigo le tiene fe a Google, que suele hacer un gran lanzamiento al año, pero hoy lo ve como el séptimo mejor, no el segundo. Espera un modelo nuevo y una aplicación ordenada, donde los Gems den paso a las skills.

¿Opus 5.5 o GPT-6 Astra para construir un sitio?

Rodrigo hizo la prueba con su sitio: el mismo proyecto en Claude y en Codex, por separado, con las mismas skills y el mismo kit de diseño. Usó Opus 5.5 en esfuerzo Medium contra Astra en X High. El primer intento de Claude le ganó con holgura, y no solo por gusto visual: storytelling, secuencia, lógica de página. Al final se quedó con Claude y solo le trajo una idea de la versión de Astra.

Cristian coincide en lo que más nota: la velocidad. Para él hay mucha diferencia entre los modelos de Anthropic y los de OpenAI. Rodrigo agrega que Opus 5.5 arregló lo que antes era lento y caro en tokens.

“Estoy en shock con Opus. El salto entre Opus 5 y 5.5 es brutal.” — Rodrigo Rojo

¿Qué recomiendan para partir?

  • Prueben un agente empaquetado. Grok Bot, Muse o los Dots no piden computador ni VPS. Para Rodrigo, lo más barato hoy es Grok Bot: úsalo en asistencia normal, no para hacer un sitio, porque se acaba rápido.
  • Metan las manos. Con lanzamientos cada dos semanas, la única forma de estar al día es probando. No se queden con la duda de si la IA podrá hacerlo.
  • Gasten tokens, pero con criterio. Cristian agotó su límite semanal de Anthropic y trabajó con ChatGPT. Rodrigo llegó dos veces al límite semanal de Claude, y con todo lo que hizo del sitio llevaba un 11% en un día y medio. Si la IA tiene que explorar tu proceso, va a gastar tokens por todos lados.
  • Ordenen su información primero. Rodrigo le dejó a su agente dónde están los datos y el formulario de inscripción a su curso, y ahora responde solo esos correos.
  • Partan con un agente personal. Cristian hizo un curso de Hermes en su comunidad y hasta su cuñado instaló uno. Rodrigo sigue prefiriendo Hermes y OpenClaw: corren en tu máquina, con tus datos, y si te enojas con un modelo le conectas otro. Con los empaquetados quedas amarrado al modelo de quien lo vende.

Capítulos del episodio

  • 00:00 — Sin Diego: Rojo y Verde solos
  • 00:57 — El captcha que faltaba y los bots en el newsletter
  • 02:35 — Migrar código legacy con IA y la mediocridad en TI
  • 07:45 — Codex y el slash goal: un objetivo grande en loop
  • 09:35 — Seis años de deuda técnica que nadie arregló
  • 11:41 — Rodrigo arma su sitio con un agente de diseño
  • 14:33 — Por qué la IA no hace dos veces lo mismo
  • 17:49 — Storytelling, manual estratégico y el nacimiento de Edna
  • 20:18 — El semáforo de estados para que no se salte etapas
  • 23:19 — Limitar la cancha: procesos, reglas y skills
  • 25:21 — Dejar de ser gratis y sacar a 1.700 miembros
  • 29:58 — Noticias: Opus 5.5, GPT-6 y el DevDay de OpenAI
  • 31:09 — Los Dots: el agente persistente dentro de ChatGPT
  • 37:00 — MiniMax y el fin de la bolsa de tokens
  • 38:02 — ChatGPT Spaces y una aplicación que se volvió compleja
  • 39:50 — Gemini 4 Argon pasó sin pena ni gloria
  • 42:00 — Opus 5.5 contra Astra armando el mismo sitio
  • 43:53 — Recomendaciones: prueben, gasten tokens con criterio y ordenen su información

Preguntas frecuentes

¿Por qué hay que ponerle límites a un agente de IA?

Porque sin un proceso claro no hace dos veces lo mismo. Las skills, los conectores y las reglas de lo que no debe inventar le dan tu estilo y le ahorran tokens explorando.

¿Cómo armar un agente de diseño web con IA?

Por capas: una skill de la plataforma, otra del sistema de diseño, un kit de recursos, skills de validación y de storytelling, y tu manual estratégico. Después lo conduces etapa por etapa.

¿Cómo evitar que la IA se salte pasos en un proceso largo?

Con un semáforo de estados: un archivo donde la IA anota en qué etapa va, para saber en cuál seguir. Si la conduces tú, no hace falta; si la dejas autónoma, sí.

¿Qué son los Dots de OpenAI?

El agente personal y persistente de ChatGPT presentado en el DevDay 2026: trabaja 24/7 con su propio computador, te escribe por iniciativa propia y la conversación no gasta tu uso. Partió en los planes de US$200.

¿Conviene un agente empaquetado o uno propio como Hermes?

El empaquetado es más fácil de partir y Grok Bot es lo más barato. El propio corre en tu máquina, con tus datos, y te deja cambiar de modelo.

Recursos mencionados

Construir con límites

Agentes de código

Noticias

Agentes personales

  • Grok — donde vive Grok Bot.
  • Hermes Agent — el agente propio que siguen prefiriendo.

Comunidades

Episodios relacionados


🌐 eslahoradeaprender.com · 🎧 Spotify · 📺 YouTube

Accesibilidad: activa los subtítulos en el reproductor de YouTube para leer la conversación completa.

← Episodio 23 Ver todos →