InicioCiencia y ComputaciónClaude Sonnet 4.6: la IA diaria más potente de Anthropic que competirá...

Claude Sonnet 4.6: la IA diaria más potente de Anthropic que competirá con GPT y Gemini

Este nuevo modelo de la familia Sonnet incorpora una ventana de contexto de 1 millón de tokens en fase beta y destaca en el uso autónomo del ordenador.
Anthropic sigue acelerando su desarrollo y acaba de presentar Claude Sonnet 4.6, una versión que combina rendimiento, rapidez y eficiencia para tareas cotidianas. El anuncio llega apenas dos semanas después del lanzamiento de Claude Opus 4.6, su modelo más avanzado para problemas complejos que requieren razonamiento profundo.
Sonnet 4.6 ya está disponible en todos los planes de Claude, incluido el gratuito. Se ha convertido en el modelo predeterminado en claude.ai y Claude Cowork, además de estar accesible en plataformas en la nube asociadas y en la API con precios desde $3/$15 por millón de tokens, igual que la versión 4.5.
La compañía también ha liberado funciones avanzadas como creación de archivos, conectores, habilidades y compactación dentro del plan Gratis, que antes estaban restringidas.

Las tres ramas de Anthropic

Anthropic organiza sus modelos en tres familias: Opus, Sonnet y Haiku.

  • Opus: el más potente en razonamiento profundo, ideal para investigación científica, análisis financiero y escritura creativa sofisticada.
  • Sonnet: más rápido y económico, pensado para uso empresarial diario, generación de contenido y asistencia técnica en software.
  • Haiku: el más ligero y veloz, diseñado para automatizar tareas repetitivas a gran escala con mínima latencia.

Qué aporta Sonnet 4.6

La desarrolladora busca que Sonnet 4.6 sea el estándar para el trabajo diario, con mejoras en razonamiento, codificación, planificación de agentes y creatividad.
Entre sus avances más destacados está la ventana de contexto de 1M tokens, que permite procesar libros completos, bases de código extensas o informes largos sin perder coherencia.
Otra gran novedad es su capacidad de “computer use”, que le permite interactuar con software real como Chrome, VS Code o LibreOffice moviendo el cursor y escribiendo en un teclado virtual, sin necesidad de APIs complejas.
En pruebas como OSWorld, Sonnet 4.6 mostró un desempeño casi humano en hojas de cálculo y formularios web, aunque aún no supera a los usuarios expertos.

Seguridad y comportamiento

El uso autónomo del ordenador plantea riesgos como el prompt injection, pero Anthropic asegura haber reforzado la resistencia de sus modelos. Según sus evaluaciones, Sonnet 4.6 mejora significativamente respecto a Sonnet 4.5 y alcanza niveles similares a Opus 4.6.
Además, se ha comprobado que es menos propenso a la “pereza” en tareas largas y mantiene un carácter cálido, honesto y prosocial, con sólidos comportamientos de seguridad.

Comparativa con otros modelos

Anthropic afirma que los usuarios prefieren Sonnet 4.6 frente a Opus 4.5 en un 59% de los casos, y que los programadores lo eligen el 70% de las veces sobre Sonnet 4.5 por su capacidad de consolidar lógica.
En pruebas externas, Sonnet 4.6 lidera en análisis financiero agéntico (63,3%) y en tareas de oficina (1633 Elo), superando a GPT y Gemini en esos campos.

  • GPT-5.2 domina en razonamiento avanzado, comprensión visual y programación en terminal.
  • Gemini 3 Pro destaca en comprensión multilingüe y visual sin herramientas.

La conclusión es clara: no existe un modelo que supere al resto en todos los ámbitos, y la competencia entre Claude, GPT y Gemini sigue siendo intensa y especializada.

ARTÍCULOS RELACIONADOS
- Advertisment -

MÁS POPULARES