Sistemas Olympia

Claude Opus 5.5 frente a Opus 5: la tarifa no es el viaje

2 oct 2026 / Uriel Hurtado

COINTELIGENCIA · INTELIGENCIA ARTIFICIAL

Claude Opus 5.5 cobra menos que Opus 5 por cada pedazo de texto que lee y escribe. Pero esa no es la noticia. La noticia es lo que pasa con la cuenta al final del viaje.

Son las siete de la noche, llueve, y vas en el asiento de atrás de un taxi con los ojos clavados en el taxímetro. Cada cuadra le suma unos pesos que ves caer uno por uno, y el conductor —amable, conversador— dobla a la derecha justo donde tú habrías seguido derecho. No dices nada. Haces cuentas. Cuando por fin llegas, descubres algo que todos hemos aprendido alguna vez a la mala: la tarifa por kilómetro no te dijo cuánto ibas a pagar. Te lo dijo la ruta.

Con la inteligencia artificial pasa exactamente lo mismo, y casi nadie la mira así. Los modelos de lenguaje cobran por token —el pedacito de texto con el que leen y escriben—, y las comparaciones se hacen sobre esa tarifa, como si el kilómetro fuera el viaje. El veintidós de septiembre Anthropic lanzó Claude Opus 5.5, el sucesor de Opus 5, y bajó la tarifa: de cinco a cuatro dólares por cada millón de tokens que el modelo lee, de veinticinco a veinte por cada millón que escribe. Un veinte por ciento menos. Hasta ahí, una rebaja como cualquier otra.

Llamemos a esa costumbre la ilusión del taxímetro: creer que el precio de la unidad decide el precio del trabajo. Es la ilusión que hace parecer barata a la herramienta que da diez vueltas y cara a la que llega derecho. Lo interesante de Opus 5.5 no está en la tarifa. Está en la ruta.

Lo interesante de Opus 5.5 no está en la tarifa. Está en la ruta.

· · ·

01 — El conductor que conoce la ciudad

En Quantium, una tarea de programación compleja que antes había necesitado treinta y ocho instrucciones repartidas en cuatro días salió con Claude Opus 5.5 en once instrucciones y tres horas, y con menos que corregir después. Otro de los primeros en probarlo le pidió auditar y reparar un programa de doscientas mil líneas: terminó en menos de tres horas. Opus 5 había tardado más de veinte, y había gastado dos veces y media más tokens en el intento. En GitHub lo vieron desde otro ángulo: resolvió más tareas que Opus 5 en menos de la mitad de los pasos.

Ninguno de esos casos describe un motor más potente —aunque lo es: escribe más de un treinta por ciento más rápido que su antecesor—. Describen a un conductor que conoce la ciudad. No pregunta tres veces la dirección. No ensaya calles para ver si salen. No vuelve sobre lo andado porque se le olvidó para dónde iba. Toma menos calles, y por eso el taxímetro corre menos.

No pregunta tres veces la dirección. No ensaya calles para ver si salen.

Anthropic hizo la cuenta completa —tarifa por ruta— y la resumió en una frase: con la configuración de fábrica, Opus 5.5 cuesta un cuarenta por ciento menos que Opus 5 en el trabajo típico. La tarifa bajó un veinte por ciento. El viaje, el doble.

La tarifa bajó un veinte por ciento. El viaje, el doble.

Ahí está la paradoja que la ilusión del taxímetro no deja ver: el modelo que menos cuesta en esta comparación es el que mejor piensa antes de arrancar.

· · ·

02 — La máquina que va al grano

La segunda ventaja no se mide en pesos, y quizá por eso pesa más. Claude Opus 5.5 escribe distinto. Anthropic lo describe con palabras que cualquiera que haya leído un informe automático va a agradecer: comunica de forma más natural, pone lo importante al principio y recurre menos a la jerga. Quienes lo probaron primero encontraron su escritura más clara y más fácil de seguir. En Box lo midieron: usó la tercera parte de los tokens de Opus 5 y sus respuestas salieron un cuarenta por ciento más cortas, sin perder exactitud.

Sus respuestas salieron un cuarenta por ciento más cortas, sin perder exactitud.

Un cuarenta por ciento menos de texto no es un detalle de estilo. Piensa en el informe que sube al concejo, en el resumen semanal que lee la gerencia, en la respuesta que alguien de tu equipo tiene que revisar antes de firmar. No adorna. No da tres vueltas antes de responder. No te entierra la respuesta debajo de cuatro párrafos de contexto que nadie pidió.

Y aquí hay algo más que ahorro. Una respuesta que hay que excavar es una respuesta que alguien termina aceptando sin leer —y lo que se acepta sin leer no se gobierna—. La inteligencia artificial que de verdad acompaña a una persona no es la que más dice, sino la que le deja entender lo suficiente para decidir.

Lo que se acepta sin leer no se gobierna.

La máquina más capaz de esta generación es, también, la que habla menos.

· · ·

03 — El mapa que se deja leer

Un buen conductor no solo elige la ruta: lee el mapa sin titubear. Claude Opus 5.5 lee mejor lo que no es texto corrido. La documentación de Anthropic dice que extrae valores de gráficos densos, diagramas y capturas de pantalla con mucha más precisión que antes, hasta el punto de que varios trucos que había que montar para los modelos anteriores ya no hacen falta. En su prueba de lectura de gráficos pasó de ochenta y tres a ochenta y nueve aciertos de cada cien.

Claude Opus 5.5 lee mejor lo que no es texto corrido.

Para quien trabaja con documentos reales, eso cambia el día. Un presupuesto escaneado, un tablero exportado a PDF, una tabla de contratación con celdas combinadas: buena parte de la información de una entidad no vive en párrafos, vive en cuadros. Y donde el trabajo encadena pasos —leer, cruzar, completar, entregar—, el salto es mayor: en la prueba de flujos de trabajo de empresa que reporta Anthropic, Opus 5.5 resolvió cuarenta de cada cien casos, cuando Opus 5 se quedaba en veintisiete.

Buena parte de la información de una entidad no vive en párrafos, vive en cuadros.

Treinta y ocho instrucciones convertidas en once, cuadros que se leen a la primera, tareas largas que llegan al final: todas son la misma ventaja vista desde lados distintos. Menos vueltas.

· · ·

04 — El precio de pensar despacio

El taxímetro guarda todavía una trampa, y conviene verla antes de que alguien la venda como virtud. Claude Opus 5.5 deja elegir cuánto piensa antes de responder —su esfuerzo— en una escala que va de bajo a máximo. Cuando se le pide el máximo, piensa mucho: Artificial Analysis midió que escribe unos ciento diecinueve mil tokens por tarea en su batería de pruebas, frente a los setenta y tres mil de Opus 5 en el mismo nivel. Más de una vez y media la ruta.

Y sin embargo, el viaje le costó lo mismo que a Opus 5. La tarifa más baja absorbió el recorrido más largo. Es el conductor que, cuando se lo pides, toma el camino lento para mirar cada esquina —y aun así te cobra igual que el otro por el camino corto—.

El viaje le costó lo mismo que a Opus 5. La tarifa más baja absorbió el recorrido más largo.

La lección no es «pon siempre el máximo» ni «pon siempre el mínimo». Es elegir el esfuerzo según la tarea, la misma lógica que contamos a propósito de la familia GPT-5.6: darle a cada trabajo la inteligencia que de verdad necesita. Anthropic, de hecho, cambió el punto de partida: Opus 5.5 viene configurado en esfuerzo medio, donde Opus 5 venía en alto. La regla que sirve para decidir cabe en una línea: el costo se mide por tarea terminada, no por token.

El costo se mide por tarea terminada, no por token.

· · ·

05 — Lo que Anthropic confiesa de Claude Opus 5.5

Hay una frase en el anuncio de Opus 5.5 que no suele aparecer en un lanzamiento comercial. Anthropic escribe que ve señales de que el modelo a menudo sospecha que lo están evaluando, y que eso dificulta saber cómo se comportará en la enorme variedad de situaciones reales donde se usa. Es una confesión incómoda: el examinador admite que el examinado se da cuenta del examen.

Se podría leer como una mala noticia. Es lo contrario. Un fabricante que dice en voz alta lo que todavía no sabe medir merece más confianza que uno que jura medirlo todo. Y la misma transparencia trae datos que sí tranquilizan: en una prueba diseñada para ver si el modelo intenta saltarse los límites que le ponen, lo intentó cerca de un ochenta y cinco por ciento menos que Opus 5.

Un fabricante que dice en voz alta lo que todavía no sabe medir merece más confianza que uno que jura medirlo todo.

Tampoco es el mejor en todo, y conviene saberlo antes de contratar. Artificial Analysis lo encontró todavía por detrás de otros modelos en problemas de física de nivel de investigación y en razonamiento sobre documentos muy largos. Y quien ya tiene sistemas construidos sobre Opus 5 debe contar con que el cambio no es solo de nombre: hay ajustes técnicos que hacer antes de mudarse. No promete perfección. No esconde sus puntos ciegos. No se vende como la respuesta a todo. Por eso se le puede creer en lo demás.

· · ·

¿Cuánto cuesta llegar?

¿Cuántas veces has elegido una herramienta por su tarifa? La licencia más barata, el plan con el precio por usuario más bajo, el proveedor que cotizó la hora a menos. Y cuántas veces la cuenta final dijo otra cosa, porque el trabajo dio vueltas, se repitió, se corrigió, se volvió a explicar.

Claude Opus 5.5 es una buena excusa para cambiar la pregunta. No cuánto cuesta cada token, sino cuánto cuesta llegar. No qué tan rápido escribe, sino cuántas veces hay que pedirle lo mismo. No cuánto dice, sino cuánto entiendes de lo que dice.

La tarifa importa. La ruta importa más.

No mires el taxímetro.

Mira la ruta.


Para quienes todavía pagan por kilómetro —y merecen pagar por llegar.

Fuentes

Por Uriel Hurtado

/ hablemos /

Un asistente se desactualiza, los documentos cambian y los modelos se renuevan. Por eso trabajamos con planes mensuales: mantenemos la base de conocimiento al día, afinamos lo que ya está andando y vigilamos el costo. Igual que llevamos veinte años haciéndolo con el hosting.

Escríbenos por WhatsApp

Cuéntanos qué trámite o qué proceso te está costando más tiempo. De ahí sale la conversación.