El precio de lista de un modelo es un mal indicador. Un agente lee el repo, reintenta, vuelve a pedir contexto y escribe logs. Una tarea media puede mover más de un millón de tokens de entrada. Por eso comparamos dólares por tarea, no el brochure.

Órdenes de magnitud, agosto 2026

  • Frontier (Opus / GPT-5.6 Sol): cerca de US$10 por tarea pesada.
  • Medio (Sonnet, Gemini Pro): alrededor de US$4.
  • Open-weight fuerte (DeepSeek V4 Pro, Qwen coder): de US$0.25 a US$0.80.

Si tu equipo lanza 200 tareas semanales en frontier, no tienes “innovación”: tienes una factura que no puedes explicarle al cliente. La política sana es: el modelo barato es el default; el caro se justifica por escrito.

Cómo lo aplicamos en proyectos

En un sitio WordPress o un flujo n8n, el 80% del trabajo es mecánico. El 20% —pagos, SEO, permisos, datos de clientes— no se improvisa. Por eso el e-commerce y el SEO no se “dejan al agente solo”. Se dirigen.

Compara modelos en DeepSeek y Qwen vs Claude y GPT y elige editor en Cursor, Claude Code y Windsurf. Si quieres que te armemos el ruteo, hablemos.