Hogar
Cursor Composer 2 frente a Claude Opus 4.6: una prueba de rendimiento reaviva el debate sobre la programación con IA
El 19 de marzo, Cursor lanzó oficialmente su modelo de programación propio, Composer 2. El anuncio desató un debate inmediato en la comunidad de desarrolladores: según Cursor, Composer 2 obtuvo una puntuación del 61,7 % en Terminal-Bench 2.0, superando notablemente el 58,0 % de Claude Opus 4.6 en condiciones de prueba idénticas.
¿Ha sido superado el modelo insignia de Anthropic por un modelo integrado en su propio IDE? A medida que se difundía la noticia, surgieron rápidamente los debates.

Tres resultados clave de las pruebas de rendimiento
Cursor publicó tres conjuntos de resultados de pruebas de rendimiento, todos ellos de dominio público:
Terminal-Bench 2.0 (tareas de programación en terminal de tipo agente): Composer 2 obtuvo una puntuación del 61,7 %, superando el 58,0 %de Claude Opus 4.6. Sin embargo, OpenAI GPT-5.4 sigue a la cabeza con un 75,1 %. CursorBench (escenarios de programación del mundo real dentro de Cursor): Composer 2 alcanzó el 61,3 %, un salto sustancial respecto al 44,2 % del anterior Composer 1.5, y también superior al 58,2 %de Claude Opus 4.6. SWE-bench Multilingual (ingeniería de software multilingüe): Composer 2 alcanzó el 73,7 %, una mejora notable con respecto a su predecesor.Sin embargo, hay un detalle que merece la pena destacar: Anthropic informó anteriormente de que Claude Opus 4.6 obtuvo un 65,4 % en Terminal-Bench 2.0 con una configuración optimizada, una cifra muy superior al 58,0 % citado por Cursor. La discrepancia se debe al marco de pruebas: Cursor utilizó entornos de agentes de terceros como Harbor y promedió los resultados de cinco ejecuciones, mientras que las cifras de Anthropic procedían de su propia configuración optimizada. Estos dos conjuntos de cifras no son directamente comparables, ya que utilizan sistemas de referencia diferentes. Cursor no eludió este tema; el comunicado indicaba explícitamente que «los resultados dependen del agente, el arnés y la configuración».
Un coste de solo una décima parte del de Opus 4.6
La rentabilidad es la verdadera ventaja oculta de Composer 2.
Con un precio de 0,50 $ / 2,50 $ por millón de tokens de entrada/salida, frente a los 5 $ / 25 $ de Claude Opus 4.6 y los 2,5 $ / 15 $ de GPT-5.4, el contraste es marcado. Cursor explica que Composer 2 se ha diseñado desde cero para tareas de codificación a largo plazo, utilizando su entrenamiento RL patentado y su tecnología de «auto-resumen» para reducir tanto la latencia como el coste, lo que describen como «inteligencia de vanguardia + velocidad extrema».
Composer 2 es el tercer modelo propio de Cursor, sucesor de Composer 1 (octubre de 2025) y de la versión 1.5 (febrero de 2026). Este lanzamiento hace hincapié en las «tareas a largo plazo» y convierte una variante más rápida y ligera en el modelo predeterminado del IDE de Cursor.
Qué significa este «resurgimiento de sus cenizas»
La decisión de Cursor de comparar directamente su modelo con Opus 4.6 marca un cambio en el panorama general de las herramientas de programación de IA.
OpenAI y Anthropic compiten en capacidades generales de vanguardia, mientras que los proveedores de herramientas verticales como Cursor han tomado un camino diferente: perfeccionar el rendimiento en tareas específicas hasta un nivel excepcional y luego utilizar las ventajas de precio para destacar. Medios de comunicación como VentureBeat y The New Stack señalaron que Composer 2 acelerará la implantación práctica del «enrutamiento multimodelo»: utilizar Opus o GPT para el razonamiento complejo y cambiar a Composer 2 para la programación cotidiana y de alta frecuencia, obteniendo beneficios en ambos frentes.
Claude Opus 4.6 se lanzó el 5 de febrero y lideró varias pruebas de rendimiento, entre ellas Terminal-Bench 2.0, Humanity's Last Exam y GDPval-AA. Los nuevos resultados de Cursor, como mínimo, plantean dudas sobre ese dominio en el segmento de la codificación especializada.
La respuesta de los desarrolladores ha sido en gran medida positiva hasta ahora, pero muchos afirman que quieren ver el rendimiento en proyectos del mundo real antes de sacar conclusiones, una postura razonable, ya que las pruebas de rendimiento no son más que eso. Cursor ya ha puesto Composer 2 a disposición de los usuarios con suscripción para una prueba gratuita dentro del IDE.
Fuente de datos: Anuncios oficiales de Cursor y principales medios tecnológicos, a 20 de marzo de 2026. Las clasificaciones actuales pueden consultarse en tbench.ai o en la página web de Cursor.
Artículo relacionado
El primer modelo de SSI de Ilya, ex científico jefe de OpenAI, se presenta
La inteligencia artificial ha alcanzado otro hito importante. Tras su salida de OpenAI, el ex científico jefe Ilya Sutskever fundó Safe Superintelligence Inc. (SSI), que ha revelado recientemente detalles sobre su modelo inaugural. Informes de redes
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
El 14 de mayo de 2026, la plataforma de desarrollo de aplicaciones de IA Lovable anunció su participación en la ronda de financiación semilla de 800.000 dólares para la startup danesa de hardware Atech. Liderada por Lovable, la ronda atrajo a firmas
Anthropic amplía las herramientas de codificación de Claude AI a Japón en su impulso por el crecimiento en el extranjero
Anthropic, una destacada empresa estadounidense de inteligencia artificial, está intensificando su alcance global. El miércoles, la compañía organizó una importante reunión de desarrolladores, "Code with Claude", en Tokio, que reunió a cerca de 500 i
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
El 19 de marzo, Cursor lanzó oficialmente su modelo de programación propio, Composer 2. El anuncio desató un debate inmediato en la comunidad de desarrolladores: según Cursor, Composer 2 obtuvo una puntuación del 61,7 % en Terminal-Bench 2.0, superando notablemente el 58,0 % de Claude Opus 4.6 en condiciones de prueba idénticas.
¿Ha sido superado el modelo insignia de Anthropic por un modelo integrado en su propio IDE? A medida que se difundía la noticia, surgieron rápidamente los debates.

Tres resultados clave de las pruebas de rendimiento
Cursor publicó tres conjuntos de resultados de pruebas de rendimiento, todos ellos de dominio público:
Terminal-Bench 2.0 (tareas de programación en terminal de tipo agente): Composer 2 obtuvo una puntuación del 61,7 %, superando el 58,0 %de Claude Opus 4.6. Sin embargo, OpenAI GPT-5.4 sigue a la cabeza con un 75,1 %. CursorBench (escenarios de programación del mundo real dentro de Cursor): Composer 2 alcanzó el 61,3 %, un salto sustancial respecto al 44,2 % del anterior Composer 1.5, y también superior al 58,2 %de Claude Opus 4.6. SWE-bench Multilingual (ingeniería de software multilingüe): Composer 2 alcanzó el 73,7 %, una mejora notable con respecto a su predecesor.Sin embargo, hay un detalle que merece la pena destacar: Anthropic informó anteriormente de que Claude Opus 4.6 obtuvo un 65,4 % en Terminal-Bench 2.0 con una configuración optimizada, una cifra muy superior al 58,0 % citado por Cursor. La discrepancia se debe al marco de pruebas: Cursor utilizó entornos de agentes de terceros como Harbor y promedió los resultados de cinco ejecuciones, mientras que las cifras de Anthropic procedían de su propia configuración optimizada. Estos dos conjuntos de cifras no son directamente comparables, ya que utilizan sistemas de referencia diferentes. Cursor no eludió este tema; el comunicado indicaba explícitamente que «los resultados dependen del agente, el arnés y la configuración».
Un coste de solo una décima parte del de Opus 4.6
La rentabilidad es la verdadera ventaja oculta de Composer 2.
Con un precio de 0,50 $ / 2,50 $ por millón de tokens de entrada/salida, frente a los 5 $ / 25 $ de Claude Opus 4.6 y los 2,5 $ / 15 $ de GPT-5.4, el contraste es marcado. Cursor explica que Composer 2 se ha diseñado desde cero para tareas de codificación a largo plazo, utilizando su entrenamiento RL patentado y su tecnología de «auto-resumen» para reducir tanto la latencia como el coste, lo que describen como «inteligencia de vanguardia + velocidad extrema».
Composer 2 es el tercer modelo propio de Cursor, sucesor de Composer 1 (octubre de 2025) y de la versión 1.5 (febrero de 2026). Este lanzamiento hace hincapié en las «tareas a largo plazo» y convierte una variante más rápida y ligera en el modelo predeterminado del IDE de Cursor.
Qué significa este «resurgimiento de sus cenizas»
La decisión de Cursor de comparar directamente su modelo con Opus 4.6 marca un cambio en el panorama general de las herramientas de programación de IA.
OpenAI y Anthropic compiten en capacidades generales de vanguardia, mientras que los proveedores de herramientas verticales como Cursor han tomado un camino diferente: perfeccionar el rendimiento en tareas específicas hasta un nivel excepcional y luego utilizar las ventajas de precio para destacar. Medios de comunicación como VentureBeat y The New Stack señalaron que Composer 2 acelerará la implantación práctica del «enrutamiento multimodelo»: utilizar Opus o GPT para el razonamiento complejo y cambiar a Composer 2 para la programación cotidiana y de alta frecuencia, obteniendo beneficios en ambos frentes.
Claude Opus 4.6 se lanzó el 5 de febrero y lideró varias pruebas de rendimiento, entre ellas Terminal-Bench 2.0, Humanity's Last Exam y GDPval-AA. Los nuevos resultados de Cursor, como mínimo, plantean dudas sobre ese dominio en el segmento de la codificación especializada.
La respuesta de los desarrolladores ha sido en gran medida positiva hasta ahora, pero muchos afirman que quieren ver el rendimiento en proyectos del mundo real antes de sacar conclusiones, una postura razonable, ya que las pruebas de rendimiento no son más que eso. Cursor ya ha puesto Composer 2 a disposición de los usuarios con suscripción para una prueba gratuita dentro del IDE.
Fuente de datos: Anuncios oficiales de Cursor y principales medios tecnológicos, a 20 de marzo de 2026. Las clasificaciones actuales pueden consultarse en tbench.ai o en la página web de Cursor.
El primer modelo de SSI de Ilya, ex científico jefe de OpenAI, se presenta
La inteligencia artificial ha alcanzado otro hito importante. Tras su salida de OpenAI, el ex científico jefe Ilya Sutskever fundó Safe Superintelligence Inc. (SSI), que ha revelado recientemente detalles sobre su modelo inaugural. Informes de redes
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
El 14 de mayo de 2026, la plataforma de desarrollo de aplicaciones de IA Lovable anunció su participación en la ronda de financiación semilla de 800.000 dólares para la startup danesa de hardware Atech. Liderada por Lovable, la ronda atrajo a firmas
Anthropic amplía las herramientas de codificación de Claude AI a Japón en su impulso por el crecimiento en el extranjero
Anthropic, una destacada empresa estadounidense de inteligencia artificial, está intensificando su alcance global. El miércoles, la compañía organizó una importante reunión de desarrolladores, "Code with Claude", en Tokio, que reunió a cerca de 500 i











