Anthropic ha presentado Claude Opus 5.5 con una promesa concreta: mejorar el rendimiento, la precisión, la comunicación y las medidas de seguridad, mientras reduce aproximadamente un 40% el coste de ejecución frente a Opus 5. Las respuestas también se generan un 30% más rápido. Además, el modelo llega con precios de API más bajos y límites de uso ampliados para los planes Pro, Max, Team y Enterprise.

La compañía afirma que se trata del modelo con mejor rendimiento que ha probado hasta ahora. Opus 5 ya ofrecía resultados elevados en rendimiento y precisión. Sin embargo, el acceso tenía un coste superior. Por tanto, Claude Opus 5.5 intenta corregir ese problema, sin dejar de atender las preocupaciones relacionadas con la seguridad.

Claude Opus 5.5 mejora la escritura y supera a Opus 5 en varias pruebas

Una de las áreas que Anthropic señala es la comunicación. Los usuarios habían identificado las respuestas de Opus 5 como demasiado extensas o difíciles de seguir, especialmente durante sesiones de trabajo prolongadas. Según los primeros evaluadores, Claude Opus 5.5 redacta de forma más natural, clara y coherente. De hecho, sus mensajes se entienden con una lectura rápida.

Un ingeniero de software de Ramp describió el cambio así: “La salida verbosa y difícil de seguir ha sido mi mayor frustración con los modelos de frontera, y Claude Opus 5.5 lo soluciona. Escribe como un buen compañero y sigue nuestras reglas de escritura”. Por su parte, un ingeniero principal de Chicago Trading Company afirmó: “Su escritura es fácil de seguir y más coherente que la de Opus 5”.

En las pruebas de rendimiento, Anthropic sitúa Claude Opus 5.5 por delante de Fable 5.1, Opus 5, GPT-6 Astra y GPT-5.6 Sol. Lo hace en programación agéntica, trabajo de conocimiento, razonamiento multidisciplinar, uso del ordenador y reconocimiento visual de gráficos. Además, en flujos de trabajo empresariales e investigación científica agéntica quedó en segundo lugar, solo por detrás de GPT-6 Astra. Todo ello mientras genera resultados un 30% más rápido que Opus 5.

Benchmarks y casos reales

Los benchmarks no son la única referencia utilizada por la compañía. Por ejemplo, en una prueba real, un evaluador pudo auditar y corregir una base de código de 200.000 líneas en menos de tres horas. Opus 5 necesitó más de 20 horas para completar la misma tarea. Además, consumió 2,5 veces más tokens.

Anthropic también comparó ambos modelos al traducir software de C a Rust. Opus 5.5 terminó el trabajo en 9,5 horas, frente a las 12 horas que necesitó Fable 5.1. Otros evaluadores de GitHub, Clio, Lovable, Quantum y Spotify compartieron resultados parecidos. En concreto, el modelo de GitHub resolvió más tareas de terminal que Opus 5 usando menos de la mitad de pasos. En cambio, el de Spotify destacó que podía completar trabajos con menor coste y en menos tiempo.

La seguridad incluye un clasificador previo a cada acción

La seguridad ocupa otra parte importante del lanzamiento. Claude Opus 5.5 incorpora un clasificador nativo que examina cada acción antes de que se ejecute. Anthropic asegura que sus defensas frente a ataques de inyección de instrucciones son iguales o superiores a las de Opus 5 en todos los entornos evaluados: programación, uso de herramientas, uso del ordenador y navegación web.

La empresa añade que, en una prueba realizada por la firma de seguridad de IA Gray Swan, Claude Opus 5.5 empató con Fable 5.1 como el modelo con la tasa más baja de éxito de inyección de instrucciones entre todos los sistemas analizados. La afirmación procede de Anthropic y forma parte de los resultados comunicados junto al lanzamiento.

La API baja de precio y el acceso llega a los planes de pago

Anthropic no ha trasladado las mejoras a un precio superior. El coste por millón de tokens de entrada baja de 5,28 euros con IVA incluido en Opus 5 a 4,22 euros con IVA incluido en Claude Opus 5.5. En los tokens de salida, la tarifa pasa de 26,39 euros con IVA incluido a 21,11 euros con IVA incluido.

  • Las lecturas de caché cuestan 0,21 euros con IVA incluido por millón de tokens, frente a 0,53 euros con Opus 5.
  • Las escrituras de caché pasan de 6,60 euros con IVA incluido a 5,28 euros con IVA incluido por millón de tokens.
  • Con las mejoras en eficiencia de tokens, el coste total de ejecución se reduce aproximadamente un 40% en cargas de trabajo habituales.

El modelo no queda limitado a desarrolladores ni al uso mediante API. También está disponible para usuarios habituales, con límites de utilización de cinco horas en los planes Pro, Max, Team y Enterprise basados en asientos. Anthropic ha publicado información adicional y testimonios detallados de los primeros evaluadores junto con el anuncio. La llegada se produce mientras el servicio amplía funciones frente a rivales como Gemini, una competencia que ya analizamos al cubrir las funciones Docs y Slides de Claude.

Puedes seguir a HardwarePremium en Facebook, Twitter (X), Instagram, Threads, BlueSky o Youtube. También puedes consultar nuestro canal de Telegram para estar al día con las últimas noticias de tecnología.

FAQ

¿Quién puede utilizar Claude Opus 5.5?

Está disponible tanto mediante API como para usuarios de los planes Pro, Max, Team y Enterprise basados en asientos. Anthropic establece límites de uso de cinco horas para esos planes.

¿Cuánto cuesta usar Opus 5.5 mediante API?

El millón de tokens de entrada cuesta 4,22 euros con IVA incluido y el de salida, 21,11 euros con IVA incluido. Las lecturas de caché cuestan 0,21 euros y las escrituras, 5,28 euros por millón de tokens.

¿Qué protección ofrece frente a la inyección de instrucciones?

Su clasificador nativo revisa las acciones antes de ejecutarlas. Anthropic afirma que iguala o supera a Opus 5 frente a estos ataques en programación, herramientas, uso del ordenador y navegación web.

¿En qué se diferencia de Opus 5?

Anthropic indica que Opus 5.5 genera respuestas un 30% más rápido, consume menos tokens en determinadas tareas y cuesta aproximadamente un 40% menos en cargas habituales.

🔥 ¿Tienes un minuto? Dale al play, te van a engancharSuscríbete al canal
🔴 NUEVOBambu Lab R1: ¡55 W de potencia láser! 🔥 #ShortsBambu Lab R1: ¡55 W de potencia láser! 🔥 #Shorts
ASUS VG27UQEL5A: el dual mode asequible que promete muchoASUS VG27UQEL5A: el dual mode asequible que promete mucho
Windows PUNTÚA tu PC y casi nadie lo sabe 😱Windows PUNTÚA tu PC y casi nadie lo sabe 😱
Los NUEVOS volantes de MOZA con Mercedes, Porsche y FordLos NUEVOS volantes de MOZA con Mercedes, Porsche y Ford
ASUS ROG Spatha X 65K: ¡12 BOTONES y 65.000 DPI! 🔥 #ShortsASUS ROG Spatha X 65K: ¡12 BOTONES y 65.000 DPI! 🔥 #Shorts

Comentarios

Cargando comentarios…
QIDI Plus5