#1: Qué modelo usamos, probamos Codex, PRs en draft y propósito vs dinero
Esta es la newsletter de 540, una publicación sobre nuestra visión del mundo de la tecnología, los negocios... y la vida.
En esta edición:
Por qué casi nadie usa el modelo barato y qué hacemos ahora que Fable se paga por uso, qué conclusiones sacamos tras una semana con Codex y por qué las PRs se suben en draft.
La falsa dicotomía: hacer cosas con propósito vs hacer cosas que generan dinero.
IA en 540
01. Solo usamos el último modelo
En ai-edge comentamos una sospecha que las métricas de uso de Claude Code confirman: de unas 30 personas, solo 8 usan de verdad modelos más baratos (Sonnet).
Concluimos que ante la duda tiramos del mejor, porque no hay forma fácil de saber si el barato es suficiente.
La lentitud de Opus no importa, lanzas varios a la vez y siguen solos mientras haces otra cosa. El problema es el coste, y ya rozamos los límites.
Así que toca mirar cómo lo hacen los que sí usan modelos baratos, y optimizar qué modelo usamos en cada paso que delegamos.
02. Para qué usar Fable
Anthropic ha sacado Fable, su modelo más capaz, de las suscripciones de equipo más baratas (Team Standard): ahora se paga por uso.
Antes de mandar al equipo el “usadlo con cuidado”, hemos escrito esta lista de cómo usarlo con criterio.
Sirve para:
Profundizar en el código que ya existe: dependencias, vulnerabilidades, un bug que no encuentras, un problema de rendimiento.
Investigar y planificar lo que aún no está escrito: arquitectura, planteamientos, valorar diferentes enfoques.
Desatascar lo que no sacas con Opus por más que insistas.
Orquestar, lanzando subagentes en modelos más baratos.
Para implementar no, ahí Opus aporta lo mismo y cuesta menos.
03. La prueba de Codex
Hemos estado una semana probando Codex en el día a día, para resolver las preguntas de la semana pasada.
En coste, el más por menos en nuestro caso no se da. La única cuenta que hay para equipos es la de 20 €, se gastó enseguida y el resto fue a coste extra.
En acoplamiento, migrar la configuración de Claude (skills, hooks, agentes) es fácil, Codex lo hace directamente al arrancar. Pero lo que está pensado para la forma de funcionar de Claude Code hay que readaptarlo. Y como no hay nada parecido a los workflows, lo que teníamos programado hay que volver a dictárselo al agente.
Codex va bien, pero no nos sale más barato ni hace nada que no tengamos ya. Readaptarse no costaría mucho, aunque no cambias la herramienta de todo un equipo sin estar muy convencido.
04. PRs en draft
En la última AI Leads salió que varios equipos han acabado haciendo lo mismo, cada uno por su lado: las PRs se suben en draft.
Antes lo revisabas tú y luego hacías el push. Ahora el flujo llega solo hasta la PR, así que la primera revisión la hacen la CI y la review de la IA, y lo que saquen ellas, o quien entre a revisarla, te vuelve como corrección que lo dispara todo otra vez.
En draft solo corren linters, tests unitarios y de integración. Los checks pesados y la review de la IA esperan a que la marques lista para revisar, y eso lo haces tú tras mirarla.
Alargamos el ciclo de feedback sin darnos cuenta, y el draft lo acorta otra vez.
Enlaces de interés
A global workspace in language models
Anthropic identifica en Claude un “J-space”: unas pocas docenas de conceptos activos que funcionan como el espacio de trabajo global de las teorías de la consciencia, y que el modelo puede reportar y modular. Si le quitan ese espacio, Claude sigue hablando con fluidez pero deja de poder razonar paso a paso.
Anthropic
ReactBench
ReactBench: benchmark que mide agentes de IA en tareas realistas de desarrollo con React, evaluando además rendimiento, accesibilidad y calidad del código, no solo si funciona.
React Bench
Herramientas en el radar
Graphify
Graphify convierte repos completos en grafos de conocimiento consultables desde Claude Code, Cursor o Gemini CLI. El parseo de código es local con tree-sitter, sin llamadas a API.
GitHub · Graphify Labs
No todo es IA en 540
01. La falsa dicotomía: propósito vs dinero
Algunas de las mejores decisiones de negocio que hemos tomado en 540 parecían irracionales cuando las tomamos. No optimizaban el corto plazo, no encajaban en un Excel y parecían directamente ineficientes.
La falsa dicotomía es pensar que tienes que elegir entre hacer dinero o hacer las cosas con propósito.
Hace poco recopilamos algunas de esas decisiones en este post y en este otro, explicando cómo acabaron convirtiéndose en una ventaja competitiva.
Enlaces de interés
Dos capítulos de uno de nuestros podcasts de referencia, Kapital, con dos personas muy unidas al mundo tecnológico que hablan sobre decisiones de negocio y de vida, irracionalidad y largo plazo.
Javier G. Recuenco · El pingüino nihilista
Kapital · Spotify
Miguel Carranza · El sueño americano
Kapital · Spotify