Claude Opus 5.5 se lanzó el martes dentro de Perplexity Computer como el nuevo nivel de esfuerzo Estándar de la plataforma, con las cifras de benchmarks publicadas por la propia cuenta de Perplexity en cuestión de minutos tras el cambio.

Conclusiones clave

  • Claude Opus 5.5 se convirtió en el nuevo nivel de esfuerzo Estándar de Perplexity Computer el martes

  • El modelo obtuvo 0.610 en el benchmark WANDR de Perplexity con un costo de $4.13 por tarea

  • Arav Srinivas dijo que Opus 5.5 se convertiría en la opción predeterminada para todos los usuarios de Perplexity Computer

  • Perplexity Computer es un producto de agente de IA basado en navegador que realiza tareas de varios pasos, incluida la investigación y las compras

El modelo obtuvo 0,610 en el benchmark interno WANDR de Perplexity, una evaluación de investigación amplia y profunda, con un costo de 4,13 dólares por tarea, logrando que el resultado “superara ligeramente” al modelo rival Fable 5.1. Perplexity Computer es el producto de agentes de IA basado en el navegador de la empresa, que realiza tareas de varios pasos como investigación y compras en nombre del usuario, en lugar de limitarse a responder consultas de chat.

El CEO de Perplexity, Arav Srinivas, siguió con su propia publicación confirmando el despliegue para todos los usuarios de Perplexity Computer, enmarcando la victoria en la eficiencia de costos en lugar de en la puntuación bruta.

Dijo que Opus 5.5 “se compara favorablemente” con Fable 5.1 “a una fracción del costo” y que se convertiría en la opción predeterminada de cara al futuro.

Una tercera cuenta, el medio de seguimiento de IA TestingCatalog, marcó de forma independiente el lanzamiento como un nuevo resultado de vanguardia en tareas de programación agencial y uso de computadoras, describiéndolo como un momento de “ralentización exponencial”, una referencia al estrechamiento de las ganancias entre lanzamientos sucesivos en la frontera.

Por qué el costo por tarea se está convirtiendo en el nuevo marcador

Los lanzamientos de modelos solían competir únicamente en la puntuación de los benchmarks. El lanzamiento de Claude Opus 5.5 marca un cambio hacia comparaciones normalizadas por costo, donde la cifra de dólares por tarea de un modelo importa tanto como la precisión sin procesar para las empresas que ejecutan agentes a escala.

El benchmark WANDR de Perplexity mide qué tan bien un modelo maneja tareas de investigación abiertas que requieren múltiples búsquedas y pasos de razonamiento, no la respuesta a una sola pregunta.

Un costo de 4,13 dólares por tarea solo importa a gran escala, y exactamente a esa escala están comenzando a llegar las implementaciones de agentes de IA empresariales.

De asistente de chat a plataforma de agentes de pago

Anthropic construyó su reputación con el chatbot Claude antes de avanzar hacia flujos de trabajo de agentes empresariales de cara a 2026, incluyendo integraciones de seguridad con firmas como la división Unit 42 de Palo Alto Networks, que comenzó a combinar modelos de Claude con herramientas de defensa continua contra amenazas.

El lanzamiento Opus 5.5 amplía ese impulso a un producto de consumo de terceros en lugar de a la interfaz propia de Anthropic, un movimiento de distribución que refleja cómo OpenAI ha colocado GPT-6 Astra dentro de herramientas de socios como el generador de video de Higgsfield AI.

También lee: El Claude de Anthropic para asesores financieros obtiene su primera prueba real con Schwab y BlackRock Data

¿Qué sucede cuando las ganancias en la frontera empiezan a encogerse?

La forma de plantearlo de TestingCatalog apunta a un debate en curso entre laboratorios de IA sobre si las generaciones sucesivas de modelos ofrecen saltos más pequeños incluso cuando los costos bajan más rápido. Si la ventaja de Opus 5.5 sobre Fable 5.1 en la puntuación resulta marginal, pero decisiva en el precio, los compradores podrían empezar a elegir modelos en función de las curvas de costos en lugar de la posición en el ranking.

Eso cambiaría la forma en que los laboratorios comercializan los lanzamientos, y qué tan rápido los rivales responden con sus propios recortes de precios.

Sigue leyendo: El impulso de la IA corporativa logra un acuerdo oficial de Anthropic en Societe Generale