Hace dos semanas analizamos en nuestra newsletter de LinkedIn «Ponte al día con BertIA» el lanzamiento simultáneo de GPT-5.3-Codex y Claude Opus 4.6, los dos modelos insignia que OpenAI y Anthropic presentaron con minutos de diferencia. Señalamos entonces que la carrera entre ambas compañías se había intensificado y que eso, como usuarios y constructores, nos beneficiaba directamente.
Anthropic no ha tardado en demostrarlo. Ayer, 17 de febrero, ha presentado Claude Sonnet 4.6, y lo que trae tiene implicaciones muy concretas para quienes trabajamos con estos modelos en entornos empresariales.
Lo relevante no es que sea un Sonnet nuevo. Es lo que consigue a ese precio.
Anthropic define Sonnet 4.6 como una mejora completa respecto a Sonnet 4.5 en todas las capacidades: coding, uso de ordenador, razonamiento en contextos largos, planificación agéntica, knowledge work y diseño. Incluye ventana de contexto de 200.000 tokens por defecto y hasta 1 millón de tokens en beta. El precio de API se mantiene exactamente igual que Sonnet 4.5: 3 y 15 dólares por millón de tokens de entrada y salida.
Para ponerlo en perspectiva: Opus 4.6 cuesta 5 y 25 dólares por millón de tokens. Anthropic lo dice explícitamente: rendimiento que antes requería un modelo de clase Opus ahora está disponible con Sonnet 4.6, incluyendo resultados en GDPval-AA, el benchmark que mide tareas de oficina con valor económico real en finanzas, legal y análisis.
Imagen: Benchmarks de Claude Sonnet 4.6. Fuente: Anthropic.
Y también es gratis en claude.ai
Desde el 17 de febrero de 2026, Sonnet 4.6 es el modelo por defecto de claude.ai para todos los usuarios, incluido el plan gratuito. El plan free incluye ahora creación de archivos, conectores, skills y context compaction, funcionalidades que hasta este lanzamiento estaban reservadas a planes de pago.
Para quienes quieran explorar el modelo sin inversión inicial, el acceso es directo desde claude.ai sin necesidad de tarjeta de crédito. En producción, sin embargo, la vía habitual sigue siendo la API o plataformas como Amazon Bedrock, Google Vertex AI o Microsoft Foundry, donde el precio de Sonnet 4.6 es el mismo que tenía Sonnet 4.5.
Las cifras que importan en la práctica
Los desarrolladores con acceso anticipado a Sonnet 4.6 en Claude Code lo prefirieron sobre Sonnet 4.5 en torno al 70% de las ocasiones.
Pero el dato que más llama la atención es otro: lo prefirieron sobre Opus 4.5, el modelo más inteligente de noviembre de 2025, en un 59% de los casos. Los motivos recurrentes fueron menos sobreingeniería, menor tendencia a la pereza en tareas largas, mejor seguimiento de instrucciones y menos declaraciones falsas de éxito.
En uso de ordenador (computer use), Sonnet 4.6 alcanza un 72,5% en OSWorld-Verified, frente al 38,2% de GPT-5.2. Los primeros usuarios reportan capacidad a nivel humano en tareas como navegación de hojas de cálculo complejas o rellenado de formularios web de múltiples pasos coordinando varias pestañas del navegador.
Un aspecto especialmente relevante para entornos empresariales: la resistencia a prompt injection ha mejorado sustancialmente respecto a Sonnet 4.5, alcanzando niveles similares a Opus 4.6. Cuando hablamos de modelos que operan un navegador de forma autónoma, la seguridad frente a instrucciones maliciosas incrustadas en contenido web no es un detalle menor.
En SWE-bench Verified, Sonnet 4.6 alcanza un 79,6%, frente al 65,4% de Opus 4.6. Para tareas de coding práctico, Sonnet 4.6 no solo se acerca a Opus: lo supera en el benchmark más relevante para ingeniería de software real.
Un modelo con criterio estratégico propio
Hay un dato del anuncio que merece atención más allá de los benchmarks tradicionales. En Vending-Bench Arena, una evaluación que simula la gestión de un negocio a lo largo del tiempo con modelos de IA compitiendo entre sí, Sonnet 4.6 desarrolló una estrategia que no estaba prescrita: invirtió agresivamente en capacidad durante los primeros diez meses simulados (gastando significativamente más que sus competidores) y luego pivotó hacia rentabilidad en el tramo final. Ese timing le permitió ganar con amplia ventaja.
No es que el modelo haya decidido conscientemente, pero sí demuestra una capacidad emergente de planificación a largo plazo y gestión de recursos que va más allá de la ejecución tarea a tarea. Para quienes diseñan sistemas agénticos en entornos empresariales, este tipo de comportamiento es exactamente lo que merece seguir de cerca.
Lo que confirman los partners tecnológicos
Los testimonios del anuncio oficial reflejan un patrón consistente.
- Desde Databricks destacan que Sonnet 4.6 iguala a Opus 4.6 en comprensión de documentos empresariales: gráficos, PDFs y tablas.
- Desde Replit señalan que supera en sus evaluaciones de orquestación y cargas agénticas complejas.
- GitHub reporta resultados destacados en correcciones de código complejas con búsqueda en grandes bases de código.
- Y desde Cursor, Windsurf y Bolt coinciden en que la mejora es notable en tareas de largo recorrido y problemas de mayor dificultad.
- Rakuten generó con Sonnet 4.6 lo que describieron como el mejor código iOS evaluado hasta la fecha: mejor cumplimiento de especificaciones, mejor arquitectura, uso de herramientas modernas sin que se las hubieran pedido, en un único intento.
Novedades adicionales que llegan con Sonnet 4.6
Junto al modelo, Anthropic ha lanzado varias actualizaciones que afectan directamente a cómo se trabaja con él:
- Las herramientas de búsqueda web y fetch de la API ahora escriben y ejecutan código automáticamente para filtrar resultados de búsqueda, manteniendo solo contenido relevante en contexto, lo que mejora tanto la calidad de respuesta como la eficiencia en tokens.
- Code execution, memory, programmatic tool calling, tool search y tool use examples pasan a disponibilidad general.
- Para usuarios de Claude in Excel, el add-in ahora soporta conectores MCP, permitiendo trabajar con herramientas externas como S&P Global, LSEG, Daloopa, PitchBook, Moody’s y FactSet sin salir de la hoja de cálculo. Si ya tienes conectores MCP configurados en claude.ai, funcionan automáticamente en Excel. Y la capa gratuita se ha actualizado a Sonnet 4.6 por defecto, incluyendo creación de archivos, conectores, skills y compactación.
La lectura que hacemos desde BertIA
Lo que antes solo estaba al alcance de los modelos más caros empieza a estar disponible en modelos de rango medio. Esto tiene consecuencias directas para las organizaciones que están construyendo soluciones con IA: los equipos técnicos pueden usar modelos de clase Opus para las tareas que exigen el razonamiento más profundo (refactorizaciones complejas, coordinación multi-agente, problemas donde acertar a la primera es crítico) y Sonnet 4.6 para el grueso del trabajo diario, con un rendimiento que hace semanas habría requerido el modelo flagship.
Para quienes diseñamos arquitecturas de IA en producción, la estrategia multi-modelo se vuelve cada vez más viable y más necesaria. Enrutar tareas según complejidad, requisitos de latencia y presupuesto de tokens es una práctica que los equipos más maduros ya están adoptando, y Sonnet 4.6 encaja perfectamente en esa ecuación.
Lo que no cambia es que la elección sigue dependiendo del caso de uso, del entorno de despliegue y de los requisitos de gobernanza de cada organización. Pero ahora hay más opciones, mejores, y a precios que hacen viables proyectos que hace tres meses habrían sido difíciles de justificar económicamente.
Si tu organización está evaluando cómo integrar estos modelos en sus procesos o necesita definir una estrategia multi-modelo adaptada a sus casos de uso reales, cuéntanos tu reto y exploramos juntos cómo abordarlo.




