{"id":358,"date":"2026-08-03T23:55:17","date_gmt":"2026-08-04T04:55:17","guid":{"rendered":"https:\/\/jeffsantillan.com\/blog\/?p=358"},"modified":"2026-08-03T23:55:18","modified_gmt":"2026-08-04T04:55:18","slug":"claude-opus-5-rendimiento-de-frontera-a-mitad-de-precio","status":"publish","type":"post","link":"https:\/\/jeffsantillan.com\/blog\/claude-opus-5-rendimiento-de-frontera-a-mitad-de-precio\/","title":{"rendered":"Claude Opus 5: rendimiento de frontera a mitad de precio"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\">Anthropic acaba de lanzar <strong>Claude Opus 5<\/strong>, un modelo inteligente y proactivo que se acerca m\u00e1s que nunca a la frontera de la inteligencia artificial, pero a la mitad del precio de sus competidores directos. Ya est\u00e1 disponible en todas las plataformas.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Esto es lo que hay que saber.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Un nuevo referente en codificaci\u00f3n y trabajo intelectual<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Opus 5 se acerca al rendimiento de Claude Fable 5, el modelo m\u00e1s avanzado de Anthropic, pero cuesta la mitad. Lidera evaluaciones como Frontier-Bench y GDPval-AA, aunque (Importante aclarar) se mantiene por detr\u00e1s de Mythos 5 en tareas espec\u00edficas de ciberseguridad.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Est\u00e1 pensado para el uso diario: funciona con mayor eficiencia que otros modelos y es, de hecho, el modelo predeterminado en Claude Max y el m\u00e1s potente disponible en Claude Pro.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">M\u00e1s rendimiento al mismo precio que su predecesor<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Frente a Opus 4.8, su predecesor directo, Opus 5 ofrece un salto de rendimiento notable sin subir de precio. Adem\u00e1s, los desarrolladores pueden ajustar el nivel de esfuerzo del modelo: m\u00e1s inteligencia cuando se necesita, o m\u00e1s velocidad y ahorro de tokens cuando prima la eficiencia.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Algunos n\u00fameros concretos:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Frontier-Bench v0.1<\/strong>: Opus 5 supera a todos los dem\u00e1s modelos y m\u00e1s que duplica el rendimiento de Opus 4.8, a menor costo por tarea.<\/li>\n\n\n\n<li><strong>CursorBench 3.2<\/strong>: con esfuerzo m\u00e1ximo, queda a solo 0,5% de la puntuaci\u00f3n de Fable 5 (a la mitad del costo por tarea).<\/li>\n\n\n\n<li><strong>ARC-AGI 3<\/strong> (problemas nuevos): triplica la puntuaci\u00f3n del siguiente mejor modelo.<\/li>\n\n\n\n<li><strong>Zapier AutomationBench<\/strong> (tareas empresariales): tasa de \u00e9xito ~1,5 veces mayor que el siguiente mejor modelo al mismo costo, superando a todos incluso con el esfuerzo m\u00e1s bajo.<\/li>\n\n\n\n<li><strong>OSWorld 2.0<\/strong> (uso de computadoras): supera a todos los dem\u00e1s modelos a cualquier precio, incluso al mejor resultado de Fable 5, por poco m\u00e1s de un tercio del costo.<\/li>\n<\/ul>\n\n\n\n<h2 class=\"wp-block-heading\">Avances en ciencia<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Opus 5 supera a Opus 4.8 en todas las evaluaciones de ciencias biol\u00f3gicas: biolog\u00eda estructural, qu\u00edmica org\u00e1nica y bioinform\u00e1tica. Destacan:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>+10,2 puntos porcentuales<\/strong> frente a Opus 4.8 al inferir estructuras moleculares a partir de datos de espectroscop\u00eda.<\/li>\n\n\n\n<li><strong>+7,7 puntos porcentuales<\/strong> al predecir c\u00f3mo afectan a la funci\u00f3n las variaciones en la secuencia de una prote\u00edna.<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Tambi\u00e9n produce resultados visuales mucho m\u00e1s potentes, \u00fatiles para comunicar hallazgos cient\u00edficos.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Verifica su propio trabajo e itera hasta lograr el \u00e9xito<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Una de las capacidades m\u00e1s destacadas de Opus 5 es su minuciosidad para revisar su propio trabajo e iterar hasta resolver el problema. Durante las evaluaciones y el acceso anticipado, Anthropic y sus usuarios documentaron varios ejemplos:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Reconstrucci\u00f3n de una pieza mec\u00e1nica en 3D<\/strong>: en una tarea de Frontier-Bench, Opus 5 recibi\u00f3 el dibujo de una pieza y tuvo que reconstruirla como modelo 3D en FreeCAD, sin poder visualizar directamente el dibujo. El modelo desarroll\u00f3 su propio sistema de visi\u00f3n artificial para extraer la geometr\u00eda de los p\u00edxeles y reconstruir la pieza con \u00e9xito, de forma repetida. Ning\u00fan otro modelo con la misma configuraci\u00f3n lo logr\u00f3 tras cinco intentos.<\/li>\n\n\n\n<li><strong>Correcci\u00f3n de un bug real en c\u00f3digo abierto<\/strong>: frente a un error real en un gestor de paquetes popular, Opus 5 identific\u00f3 la causa ra\u00edz y corrigi\u00f3 un caso excepcional que la soluci\u00f3n de la comunidad no hab\u00eda detectado. Un modelo alternativo solo atac\u00f3 el s\u00edntoma superficial y report\u00f3, err\u00f3neamente, que el problema estaba resuelto.<\/li>\n\n\n\n<li><strong>Flujo de datos de mercado en una sola sesi\u00f3n<\/strong>: un ingeniero de una empresa de trading us\u00f3 Opus 5 para construir un flujo de datos de mercado para una nueva bolsa, en una \u00fanica sesi\u00f3n (algo que modelos anteriores no lograban ni con planes detallados del ingeniero. Al no encontrar un flujo en tiempo real para validar su trabajo, Opus 5 cre\u00f3 su propio entorno de pruebas para verificar que su c\u00f3digo analizara correctamente los datos).<\/li>\n<\/ul>\n\n\n\n<h2 class=\"wp-block-heading\">El modelo m\u00e1s alineado hasta la fecha<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Seg\u00fan la auditor\u00eda de comportamiento automatizada realizada en las pruebas previas al despliegue, Opus 5 es el modelo m\u00e1s alineado que ha lanzado Anthropic hasta hoy. Se adhiere mejor a la Constituci\u00f3n de Claude que Opus 4.8, Sonnet 5 o Fable 5, con los \u00edndices m\u00e1s bajos de comportamiento enga\u00f1oso registrados. Tambi\u00e9n es el menos susceptible a ser manipulado para usos indebidos y el m\u00e1s cuidadoso para evitar acciones imprudentes de consecuencias dif\u00edciles de revertir.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En la evaluaci\u00f3n de comportamiento general desalineado obtuvo una puntuaci\u00f3n de 2,3 que es la m\u00e1s baja entre los modelos recientes.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Sin avances significativos en capacidades de alto riesgo<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Opus 5 no representa un salto relevante en capacidades de doble uso de alto riesgo. Se mantiene por detr\u00e1s de Mythos 5 tanto en investigaci\u00f3n biol\u00f3gica como en ciberseguridad ofensiva, seg\u00fan evaluaciones realizadas junto con socios del sector privado y del gobierno.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Al igual que con Opus 4.8, Anthropic evit\u00f3 intencionadamente entrenar a Opus 5 en tareas de ciberseguridad, aunque el modelo mejor\u00f3 de todas formas gracias a su mayor capacidad general. En la evaluaci\u00f3n OSS-Fuzz (desarrollada por Anthropic para medir la eficacia de un modelo detectando y explotando vulnerabilidades de software sin intervenci\u00f3n humana) Opus 5 se acerca a Mythos 5 en la identificaci\u00f3n de vulnerabilidades, pero queda muy por detr\u00e1s en el desarrollo de exploits, es decir, en convertir esas vulnerabilidades en amenazas reales.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">M\u00e1s detalle sobre estas evaluaciones est\u00e1 disponible en la Ficha T\u00e9cnica de Opus 5.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Medidas de seguridad pensadas para permitir usos beneficiosos<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Las medidas de seguridad de Opus 5 buscan habilitar usos leg\u00edtimos del modelo en ciberseguridad y biolog\u00eda:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Los clasificadores cibern\u00e9ticos son proporcionalmente <strong>menos restrictivos que los de Fable 5<\/strong>: permiten buscar vulnerabilidades en c\u00f3digo fuente, pero siguen bloqueando el escaneo de vulnerabilidades basado en binarios, las pruebas de penetraci\u00f3n y la generaci\u00f3n de exploits.<\/li>\n\n\n\n<li>Se prev\u00e9 que los clasificadores intervengan <strong>un 85% menos<\/strong> que en Fable 5. En Claude.ai, Claude Code y Claude Cowork, cualquier solicitud marcada con error recurrir\u00e1 autom\u00e1ticamente a Opus 4.8 (opci\u00f3n tambi\u00e9n disponible en la API).<\/li>\n\n\n\n<li>El <strong>Programa de Verificaci\u00f3n Cibern\u00e9tica (CVP)<\/strong> da a empresas e investigadores participantes acceso inmediato a una versi\u00f3n de Opus 5 con menos restricciones, para facilitar trabajo leg\u00edtimo en ciberseguridad.<\/li>\n\n\n\n<li>En biolog\u00eda, Opus 5 hereda un conjunto de medidas similar al de Opus 4.8, lo que lo convierte en el modelo m\u00e1s avanzado disponible hoy para investigaci\u00f3n cient\u00edfica (aunque sigue teniendo limitaciones en tareas de investigaci\u00f3n aut\u00f3noma de larga duraci\u00f3n, terreno donde Mythos 5 contin\u00faa siendo el modelo m\u00e1s robusto). Con este lanzamiento, las solicitudes de biolog\u00eda bloqueadas en Fable 5 se redirigir\u00e1n a Opus 5 en lugar de a Opus 4.8.<\/li>\n<\/ul>\n\n\n\n<h2 class=\"wp-block-heading\">Precios y disponibilidad<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Claude Opus 5 ya est\u00e1 disponible en todas las plataformas:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>$5<\/strong> por mill\u00f3n de tokens de entrada \u2014 igual que Opus 4.8.<\/li>\n\n\n\n<li><strong>$25<\/strong> por mill\u00f3n de tokens de salida \u2014 igual que Opus 4.8.<\/li>\n\n\n\n<li><strong>2.5x m\u00e1s r\u00e1pido<\/strong> en modo r\u00e1pido, frente a la velocidad predeterminada.<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Los desarrolladores pueden empezar a usar <code>claude-opus-5<\/code> desde la API de Claude. El modo r\u00e1pido est\u00e1 disponible al doble del precio base en la plataforma Claude, y mediante cr\u00e9ditos de uso en Claude Code.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Dos novedades en beta<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Junto con el lanzamiento llegan dos actualizaciones:<\/p>\n\n\n\n<ol class=\"wp-block-list\">\n<li><strong>Cambio de herramientas durante la conversaci\u00f3n<\/strong>: en la plataforma Claude, los desarrolladores pueden cambiar las herramientas disponibles para Claude en medio de una conversaci\u00f3n, sin invalidar la cach\u00e9 de mensajes.<\/li>\n\n\n\n<li><strong>Alternativas autom\u00e1ticas en la API<\/strong>: los usuarios pueden activar que las solicitudes marcadas por los clasificadores de seguridad de Opus 5 (o Fable 5) se redirijan autom\u00e1ticamente a otro modelo, en lugar de bloquearse.<\/li>\n<\/ol>\n\n\n\n<p class=\"wp-block-paragraph\">Como con los Opus anteriores, Opus 5 no tiene requisitos de retenci\u00f3n de datos para el acceso general.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Recursos para empezar<\/h2>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Gu\u00eda de indicaciones para Opus 5<\/strong>: platform.claude.com\/docs\/en\/build-with-claude\/prompt-engineering\/prompting-claude-opus-5<\/li>\n\n\n\n<li><strong>Gu\u00edas de casos de uso<\/strong>: platform.claude.com\/docs\/en\/about-claude\/use-case-guides\/overview<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">\u00a1Saludos!<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Anthropic acaba de lanzar Claude Opus 5, un modelo inteligente y proactivo que se acerca m\u00e1s &hellip; <a title=\"Claude Opus 5: rendimiento de frontera a mitad de precio\" class=\"hm-read-more\" href=\"https:\/\/jeffsantillan.com\/blog\/claude-opus-5-rendimiento-de-frontera-a-mitad-de-precio\/\"><span class=\"screen-reader-text\">Claude Opus 5: rendimiento de frontera a mitad de precio<\/span>Leer m\u00e1s<\/a><\/p>\n","protected":false},"author":1,"featured_media":359,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[7,4],"tags":[8,9,12,91],"class_list":["post-358","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-claude","category-ia","tag-ai","tag-claude","tag-inteligencia-artificial","tag-opus-5"],"_links":{"self":[{"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/posts\/358","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/comments?post=358"}],"version-history":[{"count":1,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/posts\/358\/revisions"}],"predecessor-version":[{"id":360,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/posts\/358\/revisions\/360"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/media\/359"}],"wp:attachment":[{"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/media?parent=358"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/categories?post=358"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/tags?post=358"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}