Thumbnail del episodio: Desempleo, agentes 24/7 y la carta de Dario Amodei
Episodio 22 53:45

Desempleo, agentes 24/7 y la carta de Dario Amodei

OpenAI dice que 10.000 agentes resolvieron uno de los siete problemas del milenio, el desempleo en Chile toca 9,5% y Dario Amodei pide pausar la frontera. Entre medio, Cristian cuenta cómo maneja un negocio entero con agentes 24/7.

Temas tratados

OpenAI y los 10.000 agentes que trabajaron 88 horas sobre Navier-Stokes Hombros de gigantes: por qué todo avance científico es un remix Día del programador: un año sin tocar código y desarrollando más que nunca OpenSpec y TDD: el prompt inicial decide si tu plataforma escala Desempleo en Chile al 9,5% y los estudios contradictorios de Estados Unidos

Capítulos del episodio

15 saltos · abre en YouTube

  1. 00:01 Episodio 22: matemáticos vs OpenAI, desempleo y el ensayo de Amodei
  2. 01:20 Un lunes de 175 noticias: el pipeline de Ecosistema Startup
  3. 06:00 Hermes Desktop: el agente en una máquina, la app en cualquiera
  4. 10:10 Clones virtuales: ocho proveedores probados y ganó HeyGen
  5. 14:00 Grok Bot: la tarjeta, la publicidad y el reto de tres días
  6. 16:10 Muse, bots en vez de sesiones y el miedo al terminal
  7. 20:30 Puedo manejar un negocio entero solo con agentes
  8. 23:50 Matemáticos vs OpenAI: 10.000 agentes y 88 horas
  9. 27:10 Navier-Stokes, Lean y por qué todo es un remix
  10. 31:20 Día del programador: un año sin tocar código
  11. 32:00 OpenSpec, TDD y el prompt inicial que decide si escala
  12. 37:10 Desempleo en Chile al 9,5% y la grasa corporativa
  13. 43:50 Spark de Google funciona, pero nadie lo empuja
  14. 45:50 El ensayo de Dario Amodei: pausar, no frenar
  15. 50:05 Cierre: deja al agente con /goal y sigue aprendiendo

El episodio 22 junta tres noticias que parecen de universos distintos y son la misma pregunta. OpenAI dice que 10.000 agentes resolvieron en 88 horas uno de los siete problemas del milenio. En Chile, el desempleo llegó a 9,5% y una nota de La Tercera lo conecta con la automatización. Y Dario Amodei publicó un ensayo pidiendo ponerle pausa a la frontera. Entre medio, qué probaron los tres esta semana, de Grok Bot a la aplicación de escritorio de Hermes, y una confesión de Cristian que resume el episodio: lleva un año sin tocar código y desarrolla más que nunca.

Lo que vas a aprender

  • Vas a entender qué hicieron de verdad los 10.000 agentes de OpenAI y por qué apoyarse en trabajo previo no invalida el resultado
  • Sabrás qué significa ser programador hoy y cómo pedirle a un agente que trabaje con especificaciones y pruebas aunque nunca hayas programado
  • Vas a distinguir los dos fenómenos que los titulares de desempleo mezclan: la grasa corporativa que la IA reveló y los equipos que ahora necesitan más dirección
  • Verás cómo se opera un negocio solo con agentes trabajando 24/7 y dónde queda el cuello de botella
  • Y vas a salir sabiendo qué pide el ensayo de Dario Amodei, quién dijo estar de acuerdo y por qué nadie se suma primero

¿Puede un agente resolver uno de los siete problemas del milenio?

Según OpenAI, ya pasó. Diego abre el tema con el anuncio: uno de los problemas más grandes de la matemática, sin resolver desde hace décadas, resuelto con 10.000 agentes trabajando 88 horas. El detalle que aporta después ordena la historia: los agentes llegaron a la solución unas 88 horas después de partir, y GPT-6 Astra usó 17 horas adicionales para formalizar y verificar la prueba en Lean. El problema era la suavidad de Navier-Stokes, uno de los siete problemas del milenio.

Lo que vino después fue ruido: investigadores de Anthropic habían adelantado una parte, y varios matemáticos discuten si eso cuenta como resolverlo. Para Cristian, el debate se pierde lo importante. Nadie desarrolla un lenguaje de programación nuevo para armar una página web; los investigadores tampoco parten de cero. Los agentes hacen exactamente lo mismo, y el punto es que ya están haciendo investigación: detectar patrones en ADN, resolver problemas complejos. Trabajo que nosotros ni siquiera imaginamos pedirles.

Ninguno de los tres puede pagar 10.000 agentes a la vez. Cristian hace la cuenta: sin la subvención que implica la suscripción de Claude, en vez de US$200 al mes pagaría del orden de US$18.000. Por ahora, solo los laboratorios se dan ese lujo.

Rodrigo aterriza el argumento con la frase que se repite el resto del episodio: no hay ninguna idea nueva, todo es un remix. Cualquier paper está lleno de citas porque incorpora avances de otros. Y con los matemáticos que piden que la IA no se meta en su campo es directo: si quieres seguir calculando en ábaco, adelante. AlphaFold ya predijo miles de proteínas y los científicos siguen replicándolas en laboratorio para ver qué remedios salen de ahí.

“Una vez que las cosas ya están allá afuera, es muy difícil detenerlas.” — Rodrigo Rojo

Lo mismo aplica al vibe coding: si el programa cumple el objetivo, da lo mismo cómo se escribió, y “no va a escalar” no es un argumento hasta que haga falta escalar. El asterisco es validar siempre que el problema se resolvió.

¿Qué es un programador hoy?

El domingo 13 de septiembre fue el día del programador, y Cristian aprovecha para redefinir el cargo. Estudió ingeniería en informática, le gusta meter mano al código, y lleva un año sin hacerlo. Lo que antes contrataba por Upwork o Workana ya no lo contrata: en lo que se demoraba en escribir una especificación decente para que alguien la respondiera con algo coherente, el agente ya lo desarrolló, y bien.

“Estoy desarrollando más que nunca, pero llevo un año sin meter manos al código.” — Cristian Tala

La herramienta que Rodrigo recomienda para eso es OpenSpec, una skill de Spec Driven Development. Le dices al agente qué quieres construir, te hace preguntas, escribe la especificación, y otro nivel la lee y la ejecuta. Se conecta en Claude Code, Codex, Cursor o el entorno que uses. Cristian suma su variante: pide que sea con TDD, así el agente genera las pruebas unitarias y funcionales antes de programar. No es que él haga algo por detrás para evaluarlo; solo le dice qué patrón seguir.

La tesis que Rodrigo repite en sus clases: la IA tiene condensado el conocimiento de la humanidad, pero si le haces preguntas basura te contesta desde la capa superficial. El desbloqueo está en transmitirle tu proceso, tus criterios y el contexto de tu negocio con el menor tiempo tuyo.

“Nadie conoce mejor que tú tu proceso.” — Rodrigo Rojo

Su ejemplo es Ecosistema Startup: no es una página genérica, tiene el estilo, el criterio y la validación de Cristian, aunque Cristian no haya escrito ni una nota. Eso no se hace en la ejecución del contenido, se hace en la definición del proceso. Diego agrega que por eso sigue importando tener conocimiento. Cristian lo relativiza: la diferencia entre una plataforma escalable y una que no lo es puede ser solo el prompt inicial, y si nunca estudiaste programación puedes preguntarle al mismo agente qué buenas prácticas existen y pedirle que las siga.

¿La IA está destruyendo empleo o revelando grasa corporativa?

Los datos apuntan en direcciones opuestas y Diego los pone sobre la mesa. La Tercera publicó que Chile es uno de los países con más puestos expuestos, el desempleo llegó a 9,5%, el más alto en cinco años según el INE (en el episodio se cita 9,9%), y el tiempo que la gente pasa desempleada es cada vez más largo. En Estados Unidos, un estudio reciente dice que se han creado más trabajos de los que se destruyeron, pero otros hechos casi al mismo tiempo dicen lo contrario. Y Sam Altman acaba de decir algo parecido a lo que Cristian venía diciendo: pensábamos que todo iba a pasar más rápido, pero la inercia de las empresas frenó los despidos.

Rodrigo separa dos fenómenos que los titulares mezclan. El primero son las olas de despidos en multinacionales gigantes de telecomunicaciones, banca y tecnología: empresas que por tamaño podían sumar una persona más para ejecutar sin que pesara. Esos perfiles no aportan criterio: le preguntan al jefe, ejecutan y se van. Esa ejecución la absorbe la IA.

“La llegada de la IA reveló grasa corporativa.” — Rodrigo Rojo

El segundo fenómeno es el contrario. En el resto de las empresas siempre hubo mil proyectos sin tiempo para hacerlos, y ahora los equipos desarrollan tan rápido que falta quien les dé dirección: hay compañías contratando Product Managers como nunca, porque el cuello de botella pasó a ser el humano. Y la gente que adoptó bien la IA no está saliendo más temprano; está tomando los proyectos grandes y trabajando más que antes. Diego dice que él se siente más eficiente, y Rodrigo precisa que esa es la diferencia: no son jornadas más largas, es completar tareas más rápido y pasar a otras más entretenidas.

Cristian cierra con su posición de siempre: sí creía que esto iba a pasar más rápido, y sí cree que la IA le va a quitar el empleo a muchos. Pero la misma IA que quita el empleo es la que permite tener tu propio negocio.

¿Se puede manejar un negocio entero solo con agentes?

Cristian dice que sí, y que es lo que hace. Pagar un plan caro para tener agentes 24/7 es tener especialistas trabajando 24/7, y ese es el potencial que la gente todavía no entiende. Con Rodrigo no tienen equipo, y no es por mala onda: no lo están necesitando.

“Yo puedo manejar un negocio entero solo con agentes.” — Cristian Tala

Rodrigo describe su operación. Hace cursos para empresas, cursos online y cursos en Platzi, y administra todo él. Tiene un contador que factura y lleva la contabilidad, y una persona que lo ayuda por horas cuando un curso recibe entre 50 y 100 alumnos por corte: accesos en Skool, registros, una planilla compartida. El resto de la coordinación la prefiere él, pero con un agente que revisa el correo y le avisa una vez al día qué tiene que contestar, y que encontró la forma de leerle los mensajes de WhatsApp sin tenerlo conectado. La semana pasada, enfermo después de una clase, se tiró en la cama, le escribió al agente que avanzara con las tareas, y el negocio siguió andando.

La parte honesta: al estar solo va más lento, porque no quería pasarle todo a los agentes y porque el cuello de botella real es la atención de uno, mirar lo que hacen y validarlo. Dos personas manejando agentes irían más rápido. Pero está cómodo, y no lo estaría sin ellos.

Grok Bot, Muse y Spark: agentes para quien le teme al terminal

Diego probó Grok Bot y se quedó en el primer paso: darle acceso a un agente a la tarjeta le complicó. Lo que sí notó fue la campaña, con publicidad de influencers por todos lados, y el dato del reto que quería proponerle a los otros dos. Se llama Grok Bot Galaxy: el 15, 16 y 17 de septiembre, tres ingenieros de Grok Bot van a intentar armar una empresa completa de principio a fin en tres días, presencial y con livestream.

Cristian sí lo usó, y su balance es mixto. El trial no le alcanzó para nada útil; pasó al plan de US$20 y se lo gastó el mismo día, aunque reconoce que es un usuario intensivo. Lo que le gustó: es muy fácil de usar, creas los agentes ahí mismo y viven en la nube, sin sincronizar skills entre máquinas. Lo que le faltó: algo de inteligencia en un par de tareas, que asume que la próxima versión de Grok corrige.

Rodrigo mira el patrón, no el producto. Muse, el agente que viene de Meta, ya abrió lista de espera. Lo que tienen en común estas interfaces es que conversas con un bot asociado a una cuenta, no con sesiones de chat como en Hermes u OpenClaw, y no sabes qué pasa por detrás. Eso facilita la entrada a quien le teme al terminal, que es un lugar oscuro, peligroso y muy poderoso. Hermes ya copió la idea en su aplicación de escritorio, y Rodrigo tuvo que rehacer su curso porque ya no hace falta tocar la consola. Su conclusión es la de siempre: no importa la herramienta. Entender las skills, los agentes y los perfiles sirve igual en cualquiera, porque por dentro son iguales.

Cristian pensaba que la herramienta para el usuario normal iba a ser Spark, de Google, y Rodrigo confirma que funciona muy bien y viene en el plan de US$20 de Google AI. Tiene dos frenos: los conectores hay que configurarlos a mano, buscando el MCP de cada aplicación y pegando la URL, y el modelo que corre detrás, un Gemini Flash que mejoró bastante en capacidades agénticas, todavía no es Grok 4.6, ni Claude, ni ChatGPT. Pero Google lanzó Spark y no lo empujó: con mandar un correo por Gmail a todos sus usuarios ya habría ganado. Cristian lo explica desde el negocio: Google es rentable y se puede dar el lujo de ir lento.

HerramientaQué ofreceLo que notaron esta semana
Grok BotAgentes que creas ahí mismo y viven en la nubeFácil de usar; el plan de US$20 se agota en un día para un usuario intensivo; le falta inteligencia en algunas tareas
Muse (Meta)Agente por cuenta, en lista de esperaRecién abrió inscripciones
Spark (Google)Incluido en el plan de US$20 de Google AIFunciona muy bien; conectores MCP a mano; el modelo detrás no es el de frontera; Google no lo promociona
Hermes DesktopApp en cualquier equipo conectada a la máquina del agenteListas de tareas, skills visibles, modelo por función, modo bot; ya no requiere consola

¿Qué pide de verdad el ensayo de Dario Amodei?

Más que una carta, es un ensayo, y Rodrigo lo ubica en la serie: el clásico es Machines of Loving Grace y el nuevo se llama We Must Pace the Frontier, publicado el sábado 12 de septiembre. Lo central es ponerle pausa a la frontera, no frenarla. La distinción importa porque hace un par de años circuló una carta para detener el desarrollo de la IA, firmada hasta por Elon Musk, y ChatGPT cumple cuatro años el 30 de noviembre.

El argumento de fondo es que los modelos llegaron a un punto de disrupción seria. Los que han usado Astra o Fable saben que toman una tarea compleja y la sostienen por mucho tiempo; Astra tiene el récord de velocidad jugando Pokémon, y para Rodrigo ese es el benchmark que importa, no los de Cristian. De ahí el llamado: evaluar bien estas tecnologías antes de lanzarlas, coordinación global y democrática, estructuras formales que permitan mantener el control. Con una aclaración de Rodrigo: cuando dicen coordinación global, hablan de Estados Unidos y sus gobiernos aliados.

La reacción fue unánime en la superficie: Elon Musk, Sam Altman y Satya Nadella salieron a decir que están de acuerdo. En lo que no coinciden es en las formas. “De acuerdo, pero no me sumo”: nadie quiere ser el primero, porque nadie quiere quedarse atrás ni perder competitividad a la velocidad que va esto.

Dos señales completan el cuadro. Se empezó a filtrar que Google habría alcanzado RSI: que el modelo se mejore a sí mismo en vez de esperar al siguiente entrenamiento. Si es cierto, los laboratorios vieron algo. Y desde China alguien le contestó a Amodei con la lectura opuesta: lo que describes es una nueva guerra fría de la IA, y lo que quieres es pararme porque te estoy alcanzando.

Lo que probaron esta semana

Cristian actualizó su benchmark, y cada actualización cambia sus automatizaciones. El pipeline de noticias de Ecosistema Startup falla una vez en 200 noticias: hoy es n8n llamando microservicios en Python que generan un corpus de afirmaciones validadas, del que sale un directorio donde cada startup aparece solo con información verificada en otros medios. El lunes de la grabación llevaba 175 noticias, un 94% con cifras duras, siete secciones y cinco backlinks por nota en promedio. Gasta entre US$200 y US$300 al mes, más en imágenes que en texto, y de las fallas se entera por Sentry.

También terminó un benchmark de clones virtuales con ocho proveedores, porque no quería seguir pagando HeyGen. Ganó HeyGen: los modelos locales como EchoMimic v3 lo dejaban estilizado como personaje de serie coreana. Diego confirma que es más caro pero es lo que mejor anda, y advierte sobre ApiMart, la plataforma detrás de un curso que ambos compraron: el agente se gasta los créditos rápido haciendo pruebas si las instrucciones iniciales no son claras.

Rodrigo terminó un curso de Copilot para una empresa, donde la versión empresarial ya agregó skills, y por fin instaló la aplicación de escritorio de Hermes en su computador con Linux: se conecta a la máquina donde vive el agente y permite listas de tareas, ver las skills activas y elegir qué modelo hace qué. Su siguiente experimento es convertir el computador con Windows y su tarjeta 5090 de 24 GB en un nodo que los demás agentes usen cuando esté prendido.

Capítulos del episodio

  • 00:01 — Episodio 22: matemáticos vs OpenAI, desempleo y el ensayo de Amodei
  • 01:20 — Un lunes de 175 noticias: el pipeline de Ecosistema Startup
  • 06:00 — Hermes Desktop: el agente en una máquina, la app en cualquiera
  • 10:10 — Clones virtuales: ocho proveedores probados y ganó HeyGen
  • 14:00 — Grok Bot: la tarjeta, la publicidad y el reto de tres días
  • 16:10 — Muse, bots en vez de sesiones y el miedo al terminal
  • 20:30 — Puedo manejar un negocio entero solo con agentes
  • 23:50 — Matemáticos vs OpenAI: 10.000 agentes y 88 horas
  • 27:10 — Navier-Stokes, Lean y por qué todo es un remix
  • 31:20 — Día del programador: un año sin tocar código
  • 32:00 — OpenSpec, TDD y el prompt inicial que decide si escala
  • 37:10 — Desempleo en Chile al 9,5% y la grasa corporativa
  • 43:50 — Spark de Google funciona, pero nadie lo empuja
  • 45:50 — El ensayo de Dario Amodei: pausar, no frenar
  • 50:05 — Cierre: deja al agente con /goal y sigue aprendiendo

Preguntas frecuentes

¿Qué dice el ensayo We Must Pace the Frontier de Dario Amodei?

Que hay que ponerle pausa a la frontera, no frenarla, a diferencia de la carta de hace un par de años que pedía detener el desarrollo. Los modelos ya sostienen tareas complejas por mucho tiempo y hace falta evaluarlos bien antes de lanzarlos, con coordinación global. Musk, Altman y Nadella dijeron estar de acuerdo; ninguno quiere sumarse primero.

¿OpenAI realmente resolvió uno de los siete problemas del milenio con agentes?

Según el anuncio, 10.000 agentes llegaron a la solución tras 88 horas y GPT-6 Astra usó 17 horas más para verificar la prueba en Lean. El problema es la suavidad de Navier-Stokes, uno de los siete problemas del milenio. Que investigadores de Anthropic hubieran adelantado una parte no resta: la ciencia siempre se construye sobre lo anterior.

¿La inteligencia artificial está destruyendo empleo o creándolo?

Las dos cosas, y por eso los estudios se contradicen. En Chile el desempleo llegó a 9,5%, el más alto en cinco años según el INE; en Estados Unidos hay estudios en ambas direcciones. Rodrigo separa dos fenómenos: en corporaciones gigantes la IA reveló perfiles que solo ejecutaban; en el resto de las empresas faltan Product Managers porque los equipos van más rápido de lo que alguien alcanza a dirigir.

¿Se puede manejar un negocio entero solo con agentes de IA?

Cristian dice que sí, y Rodrigo lo muestra con su operación: cursos para empresas, online y en Platzi, administrados por él con un contador y una persona por horas, y un agente que revisa el correo, le lee WhatsApp y avanza tareas mientras descansa. El límite es tu atención: alguien tiene que validar lo que hacen los agentes.

¿Qué es Spec Driven Development y por qué importa si no programo?

Es hacer que el agente escriba primero la especificación y recién después la ejecute. Con OpenSpec le dices qué quieres, te hace preguntas, redacta el spec y otro nivel lo desarrolla. Importa aunque no programes porque el prompt inicial decide si sale una plataforma escalable o no, y las buenas prácticas se las puedes preguntar al mismo agente.

Recursos mencionados

El ensayo y la ciencia

  • Ensayos de Dario Amodei — donde publica We Must Pace the Frontier y el clásico Machines of Loving Grace.
  • Lean — el asistente de pruebas formales donde se habría verificado la demostración de Navier-Stokes.
  • AlphaFold — el precedente de Rodrigo: proteínas predichas por IA que la ciencia sigue replicando.

Programar con agentes

  • OpenSpec — la skill de Spec Driven Development que recomienda Rodrigo.
  • Claude Code — uno de los entornos donde se conecta, junto a Codex y Cursor.
  • Hermes — el agente de los tres; su aplicación de escritorio ya no requiere consola.
  • Grok — la casa de Grok Bot, el agente que probaron Diego y Cristian.

Clones y producción

  • HeyGen — ganó el benchmark de ocho proveedores de clones virtuales de Cristian.
  • EchoMimic v3 — uno de los modelos locales que probó y descartó.
  • Hugging Face — donde Rodrigo encuentra modelos puntuales para su tarjeta local.

El pipeline de noticias

Episodios relacionados


🌐 eslahoradeaprender.com · 🎧 Spotify · 📺 YouTube

Accesibilidad: activa los subtítulos en el reproductor de YouTube para leer la conversación completa.

← Episodio 21 Ver todos →