In partnership with

Codex ha empezado a dejar una pista sobre cómo serán los agentes que vienen.

El catálogo de modelos puede proporcionar instrucciones distintas al agente raíz y a los subagentes: qué delegar, cómo hacerlo y qué estrategia seguir según el modelo elegido.

La parte importante no es solo que Codex delegue. Es que cada modelo puede empezar a recibir una forma distinta de coordinar el trabajo.

DE NUESTROS SOCIOS:

Speak naturally. Send without fixing.

Wispr Flow turns your voice into clean, professional text you can send the moment you stop talking. Not rough transcription you have to clean up. Actual polished text — ready for email, Slack, or any app.

Speak the way you think. Go on tangents. Change your mind mid-sentence. Flow strips the filler, fixes the grammar, and gives you text that reads like you spent five minutes writing it.

89% of messages sent with zero edits. Millions of professionals use Flow daily, including teams at OpenAI, Vercel, and Clay. Works on Mac, Windows, and iPhone.

Un agente útil no necesita usar la misma inteligencia en cada paso.

TEMA PRINCIPAL

Codex no debería delegar igual con todos los modelos

Hasta ahora era fácil imaginar la delegación como una regla fija dentro de Codex. El cambio reciente mueve parte de esa orientación al catálogo de modelos: cada modelo puede aportar instrucciones para el agente raíz y para los subagentes.

Cuando cambia el modelo, también puede cambiar la forma de decidir cuándo delegar, cómo repartir el trabajo y qué instrucciones reciben los agentes secundarios. La delegación proactiva con el nivel de razonamiento Ultra se conserva, pero la estrategia deja de ser completamente genérica.

Esto todavía está en main, no es una función estable para recomendar a todo el mundo. Pero apunta a un cambio importante: elegir un modelo podría cambiar también la orquestación del agente.

Lo que esto cambia para tus agentes

La guía para builders de GPT-5.6 explica por qué esta dirección importa: un agente mezcla tareas que necesitan código, velocidad, criterio o trabajo en paralelo.

Divide el trabajo, asigna cada paso, mide el resultado y compara.

Los números son ejemplos recogidos en la guía de OpenAI, no una única prueba: Luna conserva el 98% de la precisión de extracción a una dieciochoava parte del coste. En una evaluación de 106 tareas de navegador, completó el 78% por unos 14 dólares, frente al 80% del modelo SOTA por unos 235.

La conclusión no es usar siempre el modelo pequeño: es colocar la inteligencia cara exactamente donde cambia el resultado.

¿Cómo repartes hoy el trabajo de tus agentes?

Tu respuesta nos ayuda a decidir qué ejemplos y herramientas cubrir en los próximos correos.

Login or Subscribe to participate

SEÑALES A VIGILAR

⚡ Ultrafast

PREVIEW LIMITADA

Hasta 750 tokens por segundo y 14 veces la velocidad del modo Standard. A esa velocidad, algunos bucles de herramientas que antes eran demasiado lentos empiezan a ser viables.

🧠 Delegación por modelo

EN LA RAMA PRINCIPAL

Codex empieza a recibir orientación distinta según el modelo elegido. Todavía no es estable, pero la dirección es clara.

Y PARA ACABAR…

La siguiente mejora no será solo otro modelo

Será un sistema que sepa decidir qué hace cada parte: cuándo usar código, cuándo pedir razonamiento, cuándo conservar contexto y cuándo repartir el trabajo.

¿Qué parte de tu agente sigue usando el modelo más potente aunque podría resolverla una herramienta?

Un abrazo,
Kiko

¿Te reenviaron este correo? Regístrate aquí para recibir cada lunes una idea importante, una aplicación concreta y solo las novedades que merezcan atención.

Reply

Avatar

or to participate

Seguir leyendo

View more
caret-right