El precio de lista de un modelo es un mal indicador. Un agente lee el repo, reintenta, vuelve a pedir contexto y escribe logs. Una tarea media puede mover más de un millón de tokens de entrada. Por eso comparamos dólares por tarea, no el brochure.
Órdenes de magnitud, agosto 2026
- Frontier (Opus / GPT-5.6 Sol): cerca de US$10 por tarea pesada.
- Medio (Sonnet, Gemini Pro): alrededor de US$4.
- Open-weight fuerte (DeepSeek V4 Pro, Qwen coder): de US$0.25 a US$0.80.
Si tu equipo lanza 200 tareas semanales en frontier, no tienes “innovación”: tienes una factura que no puedes explicarle al cliente. La política sana es: el modelo barato es el default; el caro se justifica por escrito.
Cómo lo aplicamos en proyectos
En un sitio WordPress o un flujo n8n, el 80% del trabajo es mecánico. El 20% —pagos, SEO, permisos, datos de clientes— no se improvisa. Por eso el e-commerce y el SEO no se “dejan al agente solo”. Se dirigen.
Compara modelos en DeepSeek y Qwen vs Claude y GPT y elige editor en Cursor, Claude Code y Windsurf. Si quieres que te armemos el ruteo, hablemos.