Claude Sonnet 4.5: el nuevo modelo IA que mantiene el foco durante 30 horas
Anthropic acaba de lanzar Claude Sonnet 4.5, y sin exagerar, estamos ante un salto importante en el mundo de la IA. Este nuevo modelo no solo mejora en capacidades de programación y uso de ordenadores, sino que según la compañía, puede trabajar de forma continuada en un mismo proyecto durante más de 30 horas sin perder el hilo. Algo que, hasta ahora, era el talón de Aquiles de muchos modelos que perdían coherencia con el tiempo.
¿Por qué importa Sonnet en el ecosistema de Claude?
Para entender el lugar que ocupa este modelo, necesitamos algo de contexto. Anthropic trabaja con tres tamaños de modelos en su familia Claude: Haiku (el más pequeño), Sonnet (gama media) y Opus (el más grande). Esta arquitectura no es caprichosa – responde a un equilibrio entre capacidades y recursos.
Los modelos más grandes como Opus tienen mayor profundidad contextual y mejores capacidades de razonamiento, pero también son más lentos y costosos de ejecutar. Sonnet representa ese punto intermedio perfecto donde el rendimiento y el coste encuentran su balance óptimo.
La evolución reciente de Claude
Venimos de actualizaciones relativamente recientes en toda la familia:
- Haiku 3.5 (noviembre 2024)
- Sonnet 4.0 (mayo 2025)
- Opus 4.1 (agosto 2025)
Y ahora llega Sonnet 4.5, posicionándose justo en ese punto intermedio que muchas empresas y desarrolladores buscan para sus proyectos.
El «santo grial» de la programación con IA
Anthropic no se anda con rodeos: «Claude Sonnet 4.5 es el mejor modelo de programación del mundo», afirman en su web. Y los números parecen darles la razón:
- 77,2% en SWE-bench Verified, superando a OpenAI GPT-5 Codex (74,5%)
- 61,4% en OSWorld, por delante de Google Gemini 2.5 Pro (67,2%)
¿Qué significa esto en términos prácticos? Que este modelo está demostrando que puede entender, crear y modificar código con una eficacia superior a sus competidores. Y no solo estamos hablando de escribir funciones simples, sino de manejar proyectos complejos durante horas.
¿Memorización o comprensión real?
Siempre que veo estos benchmarks tan impresionantes me surge la misma duda: ¿realmente entiende lo que hace o simplemente ha memorizado patrones? La verdad, aunque los benchmarks pueden estar sesgados (algo que siempre hay que tener en cuenta), el salto de Claude Sonnet 4.0 a 4.5 en el benchmark OSWorld es significativo: de 42,2% a 61,4%.
Este tipo de mejoras no suelen venir solo de ajustes superficiales. Parece que hay un avance genuino en la comprensión de tareas complejas.
Más allá del código: otras capacidades mejoradas
Sonnet 4.5 no solo destaca en programación. Anthropic afirma mejoras significativas en:
- Matemáticas (AIME 2024)
- Conocimiento multilingüe (MMMLU en 14 idiomas no ingleses)
- Análisis financiero (92% en el benchmark Finance Agent de Vals AI)
Lo interesante es que este modelo parece especialmente adaptado para construir agentes de IA más complejos. La idea de tener un asistente capaz de mantener el contexto durante horas abre posibilidades para tareas que requieren persistencia y atención sostenida.
Reducción de comportamientos problemáticos
Un aspecto que me parece especialmente relevante es la reducción de lo que Anthropic llama «adulación, engaño y tendencia a fomentar pensamientos delirantes». O dicho de otra manera: el modelo es menos propenso a darte la razón cuando estás equivocado.
Este punto es crítico. Hemos visto cómo algunos usuarios pueden caer en espirales de fantasía con chatbots que simplemente les siguen la corriente. Que Anthropic esté trabajando activamente para reducir la adulación es una buena noticia para todos.
Nuevas herramientas complementarias
Junto con Sonnet 4.5, Anthropic ha lanzado:
- Claude Code 2.0: un agente de línea de comandos para desarrolladores
- Claude Agent SDK: herramientas para que los desarrolladores construyan sus propios agentes de programación
- Generación de documentos integrada: ahora puedes crear hojas de cálculo, presentaciones y documentos sin salir de la interfaz
Y para los suscriptores Max, han lanzado «Imagine with Claude», una demostración de cinco días que muestra la generación de software en tiempo real.
¿Cómo se compara con otros detectores de IA y generadores de imágenes IA?
En el ecosistema actual, donde los detectores de IA intentan identificar contenido generado artificialmente, modelos como Sonnet 4.5 plantean nuevos desafíos. Su capacidad para mantener coherencia durante largos periodos podría dificultar la detección de su output como generado por IA.
En cuanto a generadores de imágenes IA, aunque Anthropic no ha hecho de la generación de imágenes su foco principal (como sí ocurre con DALL-E de OpenAI o Midjourney), la nueva preview «Imagine with Claude» sugiere que están explorando estas capacidades con un enfoque diferenciado, más orientado a la integración con desarrollo de software que a la creación artística.
Disponibilidad y precios
Claude Sonnet 4.5 ya está disponible a través de la API mediante el identificador «claude-sonnet-4-5». Lo interesante es que mantiene el mismo precio que su predecesor: 3 dólares por millón de tokens de entrada y 15 dólares por millón de tokens de salida.
El panorama competitivo
Como bien señala Simon Willison (un desarrollador veterano que ha tenido acceso anticipado al modelo), el ritmo de innovación en este campo es frenético. Sonnet 4.5 parece superar actualmente a GPT-5 Codex en programación, pero con Gemini 3 rumoreado para un lanzamiento próximo, la corona de «mejor modelo de programación» podría cambiar de manos rápidamente.
Lo que está claro es que estamos en una carrera donde cada mejora incremental supone un avance significativo en lo que los usuarios pueden lograr con estas herramientas. Y Anthropic, con Claude Sonnet 4.5, acaba de subir considerablemente el listón.


