Publicado en

Claude Opus 5.5 quiere arreglar uno de los mayores problemas de Claude Code: ser más listo gastando menos tokens

Claude Opus 5.5 y Claude Code, destacando menor consumo de tokens

Anthropic acaba de presentar Claude Opus 5.5, la primera incorporación de su nueva familia Claude 5.5. Como era de esperar, la compañía habla de mejoras de rendimiento, programación y trabajo con agentes, pero quizá la novedad más importante no sea que el modelo sea más capaz. Es que debería necesitar menos tokens para hacer el mismo trabajo.

Y esto es especialmente importante para Claude Code.

Durante las últimas semanas se han multiplicado las quejas de usuarios que aseguran consumir sus límites de Claude mucho más rápido de lo esperado, incluso utilizando planes Max. Son experiencias individuales, no una medida global del consumo de Claude Code, pero sí reflejan una frustración recurrente entre parte de sus usuarios.

Opus 5.5 parece diseñado, al menos en parte, para atacar precisamente ese problema.

Más capacidad, pero también menos vueltas para llegar al resultado

Anthropic asegura que Claude Opus 5.5 mejora a Opus 5 en programación con agentes, uso del ordenador y trabajo profesional. La propia compañía reconoce, eso sí, que a este nivel las diferencias entre benchmarks ya no siempre reflejan bien lo que ocurre en el uso real.

Pero hay otro dato bastante más interesante cuando hablamos de herramientas como Claude Code: Opus 5.5 utiliza menos tokens por tarea.

GitHub ha llegado a una conclusión similar en sus primeras pruebas. En GitHub Copilot, Opus 5.5 resolvió tareas con resultados comparables a Opus 5, pero utilizando significativamente menos pasos y tokens. Es una prueba realizada en Copilot, no directamente en Claude Code, aunque apunta a una mejora del propio modelo especialmente relevante para cualquier agente de programación.

Eso importa porque un agente no funciona como un chatbot convencional. Tiene que leer archivos, explorar repositorios, ejecutar herramientas, comprobar resultados, corregirse y continuar trabajando. Cada vuelta adicional puede aumentar el consumo de contexto y, por tanto, acelerar la llegada a los límites de uso.

De hecho, Anthropic afirma que la ventaja de Opus 5.5 en eficiencia es especialmente clara: cuesta menos por token y además usa menos tokens por tarea.

Claude Code tenía un problema de consumo

Esta mejora llega además en un momento bastante oportuno para Anthropic.

Durante septiembre han aparecido numerosas quejas entre usuarios de Claude Code sobre los límites de utilización. Algunos usuarios relatan que determinadas sesiones y tareas largas consumen una parte importante de sus cuotas mucho antes de lo que esperaban.

Conviene no convertir esas experiencias en una estadística general: el consumo depende del tamaño del proyecto, del contexto, de las herramientas utilizadas, del modelo y del número de pasos que necesite el agente. Pero el problema de fondo es real desde el punto de vista práctico: en un agente importa mucho cuánto trabajo útil consigue hacer por cada token y cada llamada.

Un modelo puede ser más caro por token y, aun así, terminar siendo más eficiente si resuelve un problema en diez pasos en lugar de treinta. GitHub explica precisamente que medir solo la longitud de una respuesta puede ser engañoso: lo importante es el coste de completar la tarea entera.

Y ahí es donde Opus 5.5 parece haber dado uno de sus saltos más importantes.

También es más rápido y más barato

Anthropic afirma que Opus 5.5 genera salida más de un 30 % más rápido que Opus 5 y cuesta alrededor de un 40 % menos en cargas de trabajo habituales con la configuración predeterminada.

El precio mediante API también baja respecto a Opus 5 hasta los 4 dólares por millón de tokens de entrada y 20 dólares por millón de salida. Las lecturas de caché, especialmente importantes en programación y agentes, pasan a costar 0,20 dólares por millón de tokens, un 60 % menos que en Opus 5.

La combinación es importante: no solo cuesta menos cada token, sino que el modelo debería necesitar menos tokens para completar determinadas tareas.

Anthropic cita incluso una prueba sobre una base de código de 200.000 líneas en la que Opus 5.5 terminó el trabajo en menos de tres horas, frente a más de 20 horas con Opus 5, y utilizando 2,5 veces menos tokens. Es una prueba de un evaluador temprano, no un resultado universal, pero ilustra bien la clase de mejora que la compañía quiere vender con este modelo.

Claude Code es probablemente donde más se notará

Aunque Opus 5.5 está disponible como modelo general de Claude, donde más sentido tienen estas mejoras es en Claude Code y otras aplicaciones basadas en agentes.

La carrera entre OpenAI, Anthropic y Google ya no consiste únicamente en quién responde mejor una pregunta. Los modelos cada vez pasan más tiempo trabajando de forma autónoma, utilizando herramientas y completando procesos largos.

Ahí la eficiencia empieza a ser casi tan importante como la inteligencia.

Un agente que obtiene un resultado ligeramente mejor pero necesita millones de tokens puede acabar siendo menos útil que otro capaz de resolver el mismo problema utilizando una fracción de los recursos.

Anthropic asegura además que Opus 5.5 mejora la claridad de las respuestas, coloca antes la información importante y sigue mejor las instrucciones de estilo. La compañía reconoce que la forma de comunicarse de Opus 5 había sido una de las áreas donde más comentarios recibió de los usuarios.

Anthropic también aumenta los límites de uso

Hay otra novedad que probablemente agradecerán los usuarios de Claude.

Junto con Opus 5.5, Anthropic ha anunciado que aumentará los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise por asiento. También permitirá guardar un restablecimiento del límite para utilizarlo cuando el usuario lo necesite.

No sabemos todavía hasta qué punto la combinación de esos nuevos límites y la mayor eficiencia del modelo cambiará la experiencia real de Claude Code. Eso necesitará pruebas fuera de los benchmarks y de los evaluadores tempranos.

Pero la dirección es bastante clara: Opus 5.5 no busca únicamente mejorar puntuaciones. Anthropic quiere que sus agentes hagan más trabajo con menos pasos, menos tokens y menos coste.

Y para quien utiliza Claude Code durante varias horas al día, esa mejora puede ser bastante más importante que sumar unos cuantos puntos en otro benchmark.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *