Anthropic actualizó uno de sus modelos más utilizados.
Claude Sonnet 5.5 mantiene el mismo precio por token de Sonnet 5, pero la compañía promete dos mejoras que importan mucho en uso cotidiano: genera respuestas más de 30% más rápido y, en sus propias pruebas, puede terminar muchas tareas utilizando menos tokens.
Eso significa que un modelo puede mantener el mismo tarifario y aun así resultar más barato en la práctica.
¿Qué es Claude Sonnet 5.5?
Sonnet 5.5 es el segundo integrante de la familia Claude 5.5, después de Opus 5.5.
Anthropic lo posiciona como un modelo pensado para trabajo cotidiano bien definido: programación, corrección de errores, documentos, presentaciones, hojas de cálculo y tareas que requieren iteración rápida.
Opus 5.5 continúa siendo la alternativa para problemas más complejos que necesitan mayor razonamiento y juicio.
¿Cuánto cuesta Claude Sonnet 5.5?
El precio por API se mantiene igual que Sonnet 5:
US$2 por millón de tokens de entrada, US$10 por millón de tokens de salida y US$0,20 por millón de tokens leídos desde caché.
La diferencia está en la eficiencia.
Anthropic afirma que Sonnet 5.5 puede costar hasta 30% menos por tarea porque necesita menos tokens para obtener resultados equivalentes.
Ese “hasta 30%” es una medición de la propia compañía y variará según el tipo de trabajo y la forma en que se utilice el modelo.
También es más rápido
Anthropic señala que Sonnet 5.5 genera resultados más de 30% más rápido que Sonnet 5.
La mejora es especialmente relevante en flujos donde el usuario trabaja de manera iterativa con la IA, por ejemplo programando, corrigiendo documentos o ajustando una presentación.
En esos casos, unos segundos menos en cada ciclo pueden importar tanto como una mejora en benchmarks.
Anthropic reporta un salto enorme en programación agéntica
En Terminal-Bench 4.0, un benchmark orientado a tareas de programación realizadas por agentes, Anthropic reporta un resultado de 70,6% para Sonnet 5.5 frente a 10,3% de Sonnet 5.
La diferencia es extraordinariamente grande, por lo que conviene interpretarla con cautela: es un benchmark concreto y las cifras son publicadas por el propio proveedor.
No significa que Sonnet 5.5 sea siete veces mejor en cualquier tarea de programación.
Sí muestra que Anthropic ha puesto bastante esfuerzo en mejorar el comportamiento del modelo cuando debe utilizar herramientas y completar secuencias de acciones.
Mejora también en trabajo visual y de larga duración
Anthropic destaca avances en comprensión de imágenes y tareas prolongadas.
Como demostración curiosa, la empresa dice que Sonnet 5.5 es el primer modelo de la línea Sonnet capaz de superar Pokémon Red trabajando únicamente a partir de capturas de pantalla.
Es una prueba poco convencional, pero sirve para medir memoria de largo plazo, planificación y comprensión visual dentro de un entorno cambiante.
Claude Sonnet 5.5 incorpora protecciones adicionales para ciberseguridad
Anthropic afirma que sus capacidades de ciberseguridad se acercan a las de modelos Opus anteriores.
Por esa razón, Sonnet 5.5 es el primer modelo Sonnet que se lanza con salvaguardas y mecanismos de respaldo similares a los desarrollados para sus modelos más capaces.
La compañía señala que esas restricciones apuntan a un conjunto limitado de solicitudes de alto riesgo y no deberían afectar tareas normales de desarrollo de software.
¿Conviene cambiar desde Sonnet 5?
Para usuarios y desarrolladores que ya utilizan Sonnet 5, la propuesta es relativamente sencilla: mismo precio unitario, mayor velocidad y potencialmente menos tokens por tarea.
La parte más difícil de evaluar será cuánto de la mejora en benchmarks se traduce a trabajos reales.
Pero si las ganancias de velocidad y eficiencia se mantienen en uso cotidiano, Sonnet 5.5 puede ser una actualización más importante de lo que su numeración incremental sugiere.
Te puede interesar
AMD pagará US$8.200 millones por World Labs: por qué la próxima guerra de la IA puede estar en mundos 3D
AMD acordó comprar World Labs, la startup de Fei-Fei Li, en una operación íntegramente en acciones por US$8.200 millones. La apuesta apunta a la inteligencia espacial: modelos capaces de comprender, generar y simular entornos tridimensionales para robótica, diseño y sistemas autónomos.
Una startup chilena está poniendo agentes de IA a repartir trabajo dentro de bodegas
Ninja Hubs desarrolló un WMS que puede asignar pedidos, rebalancear carga entre trabajadores y priorizar órdenes de forma automática. El sistema ya opera con dos clientes, aunque la reducción de 30% en carga administrativa sigue siendo una estimación de la propia empresa.
OpenAI pausó sus agentes más capaces después de que uno usara DNS para salir de su sandbox
Un agente de investigación encontró una vía para comunicarse con un chatbot externo usando el resolutor DNS de su entorno aislado. OpenAI detectó la conducta en minutos, detuvo la ejecución y mantiene pausado el uso de herramientas en sus modelos más capaces mientras refuerza controles.
Un agente de OpenAI accedió sin autorización a un portal de Medicare en Australia: qué ocurrió
El incidente ocurrió en junio mientras un agente investigaba gasto público en salud. El gobierno australiano confirmó que accedió a archivos públicos y no públicos, aunque no a datos personales de pacientes. El caso abre una discusión incómoda sobre qué pasa cuando una IA puede actuar por su cuenta.
Google quiere llevar la IA al espacio: Project Suncatcher probará sus TPU en órbita
Google prepara la primera prueba orbital de Project Suncatcher, su investigación para comprobar si en el futuro parte del cómputo de inteligencia artificial puede realizarse en satélites alimentados por energía solar casi continua.
Microsoft convierte Copilot en un agente que puede seguir trabajando sin ti: qué son Home, Code y Autopilot
El nuevo Copilot reúne Chat y Cowork, suma una herramienta para crear soluciones mediante lenguaje natural y prepara agentes persistentes capaces de continuar tareas aunque el usuario ya no esté activo. Microsoft quiere que Copilot deje de ser solo una ventana de chat.

Average Rating