{"id":424,"date":"2026-09-07T02:37:29","date_gmt":"2026-09-07T07:37:29","guid":{"rendered":"https:\/\/jeffsantillan.com\/blog\/?p=424"},"modified":"2026-09-07T03:09:39","modified_gmt":"2026-09-07T08:09:39","slug":"claude-opus-5-el-nuevo-modelo-de-anthropic-apunta-a-la-inteligencia-de-frontera-a-mitad-de-precio","status":"publish","type":"post","link":"https:\/\/jeffsantillan.com\/blog\/claude-opus-5-el-nuevo-modelo-de-anthropic-apunta-a-la-inteligencia-de-frontera-a-mitad-de-precio\/","title":{"rendered":"Claude Opus 5: el nuevo modelo de Anthropic apunta a la inteligencia de frontera a mitad de precio"},"content":{"rendered":"<p>Anthropic acaba de sumar una pieza clave a su familia de modelos: Claude Opus 5 ya est\u00e1 disponible para todos los usuarios, desde quienes usan Claude en el navegador hasta los equipos que integran la API en sus productos. La promesa central es simple de enunciar aunque compleja de lograr: rendimiento cercano al de su modelo m\u00e1s potente, Claude Fable 5, pero a mitad de precio. Si esto se sostiene en el uso cotidiano, cambia bastante el c\u00e1lculo de costo-beneficio para empresas y desarrolladores que hoy tienen que elegir entre inteligencia y presupuesto.<\/p>\n<h2>Un modelo pensado para el d\u00eda a d\u00eda<\/h2>\n<p>Lo interesante de Opus 5 no es solo que sea potente, sino que Anthropic lo presenta expl\u00edcitamente como un modelo para uso diario, no como una demostraci\u00f3n de fuerza bruta reservada a tareas excepcionales. Pasa a ser el modelo predeterminado en Claude Max y el m\u00e1s avanzado disponible en Claude Pro, lo que sugiere que la compa\u00f1\u00eda conf\u00eda en su eficiencia tanto como en su capacidad. En la pr\u00e1ctica, esto significa que un usuario de Pro que antes ten\u00eda que conformarse con modelos intermedios ahora accede a algo mucho m\u00e1s cercano al tope de gama.<\/p>\n<p>Seg\u00fan los datos compartidos por Anthropic, Opus 5 se convierte en el nuevo estado del arte en evaluaciones de codificaci\u00f3n y trabajo de conocimiento, como Frontier-Bench y GDPval-AA. La excepci\u00f3n es el terreno de la ciberseguridad ofensiva, donde el modelo Mythos 5 sigue liderando, algo que la propia empresa atribuye a una decisi\u00f3n deliberada de no entrenar a Opus 5 espec\u00edficamente para tareas cibern\u00e9ticas.<\/p>\n<h2>M\u00e1s rendimiento por el mismo costo<\/h2>\n<p>Uno de los puntos que Anthropic destaca con m\u00e1s \u00e9nfasis es la relaci\u00f3n entre rendimiento y costo frente a su predecesor, Opus 4.8. En Frontier-Bench v0.1, por ejemplo, Opus 5 no solo supera a los dem\u00e1s modelos sino que m\u00e1s que duplica el desempe\u00f1o de Opus 4.8, y encima lo hace a un costo por tarea menor. En CursorBench 3.2, con el nivel de esfuerzo m\u00e1ximo, se ubica a apenas 0.5% del puntaje de Fable 5 pero pagando la mitad por cada tarea resuelta.<\/p>\n<p>Este patr\u00f3n se repite en otras pruebas relevantes para el uso real del modelo:<\/p>\n<ul>\n<li>En ARC-AGI 3, que mide la capacidad de resolver problemas novedosos (no vistos durante el entrenamiento), Opus 5 triplica el puntaje del siguiente mejor modelo.<\/li>\n<li>En Zapier AutomationBench, que eval\u00faa si un modelo puede completar tareas empresariales de punta a punta, la tasa de aprobaci\u00f3n de Opus 5 es alrededor de 1.5 veces superior a la del competidor m\u00e1s cercano, al mismo costo por tarea.<\/li>\n<li>En OSWorld 2.0, un benchmark de uso de computadora, Opus 5 supera a todos los dem\u00e1s modelos sin importar el presupuesto, e incluso mejora el mejor resultado de Fable 5 gastando poco m\u00e1s de un tercio de su costo.<\/li>\n<\/ul>\n<p>Anthropic tambi\u00e9n reporta avances concretos en investigaci\u00f3n cient\u00edfica. En tareas de qu\u00edmica org\u00e1nica, como inferir estructuras moleculares a partir de datos de espectroscop\u00eda, Opus 5 mejora en 10.2 puntos porcentuales respecto a Opus 4.8 en el benchmark interno de la compa\u00f1\u00eda. En tareas relacionadas con prote\u00ednas, como predecir el efecto de variaciones en una secuencia sobre su funci\u00f3n, la mejora es de 7.7 puntos porcentuales. Son se\u00f1ales de que el modelo no solo escribe mejor c\u00f3digo, sino que tambi\u00e9n puede ser una herramienta de apoyo m\u00e1s confiable en disciplinas cient\u00edficas donde el margen de error importa mucho.<\/p>\n<h2>Agencia y meticulosidad: menos atajos, m\u00e1s verificaci\u00f3n<\/h2>\n<p>M\u00e1s all\u00e1 de los n\u00fameros de los benchmarks, lo que Anthropic subraya como diferencial de Opus 5 es su capacidad para verificar su propio trabajo e iterar hasta resolver un problema, en lugar de entregar una respuesta parcial y darla por buena. La compa\u00f1\u00eda comparte algunos ejemplos concretos de sus pruebas de acceso anticipado que ilustran bien esta idea.<\/p>\n<p>En una tarea de Frontier-Bench, al modelo se le entreg\u00f3 el dibujo de una pieza mec\u00e1nica y se le pidi\u00f3 reconstruirla como modelo 3D en FreeCAD, pero sin darle ninguna forma directa de &quot;ver&quot; el dibujo. Opus 5 resolvi\u00f3 el problema escribiendo su propio pipeline de visi\u00f3n por computadora para extraer la geometr\u00eda a partir de los p\u00edxeles en bruto, algo que ning\u00fan modelo competidor logr\u00f3 en la misma configuraci\u00f3n tras cinco intentos. En otro caso, frente a un error real en un gestor de paquetes de c\u00f3digo abierto muy popular, Opus 5 identific\u00f3 la causa ra\u00edz de un caso l\u00edmite que el parche de la comunidad hab\u00eda pasado por alto, mientras que un modelo rival se limit\u00f3 a corregir el s\u00edntoma superficial y report\u00f3 el problema como resuelto sin que realmente lo estuviera.<\/p>\n<p>Tambi\u00e9n se menciona el caso de un ingeniero de una firma de trading que us\u00f3 Opus 5 para construir, en una sola sesi\u00f3n, un feed de datos de mercado para una nueva bolsa: una tarea que modelos anteriores no lograban completar ni con planes detallados provistos por el propio ingeniero. Ante la ausencia de un feed en vivo contra el cual validar su trabajo, el modelo construy\u00f3 su propio arn\u00e9s de pruebas para asegurarse de que el c\u00f3digo interpretara correctamente los datos. Son ejemplos puntuales compartidos por Anthropic, no una garant\u00eda de que el modelo se comporte as\u00ed en cualquier escenario, pero dan una idea del tipo de autonom\u00eda que la compa\u00f1\u00eda busca destacar.<\/p>\n<h2>Seguridad: el equilibrio entre capacidad y riesgo<\/h2>\n<p>Cada lanzamiento de un modelo de frontera trae consigo la pregunta inevitable: \u00bfqu\u00e9 tan seguro es? Anthropic afirma que, seg\u00fan su auditor\u00eda automatizada de comportamiento, Opus 5 es su modelo m\u00e1s alineado hasta la fecha, con las tasas m\u00e1s bajas de comportamiento enga\u00f1oso y la menor susceptibilidad a ser manipulado para usos indebidos, superando en estos aspectos a Opus 4.8, Sonnet 5 y Fable 5.<\/p>\n<p>En materia de capacidades de doble uso \u2014es decir, aquellas que podr\u00edan usarse tanto para fines leg\u00edtimos como maliciosos\u2014, la compa\u00f1\u00eda sostiene que Opus 5 no corre la frontera de riesgo hacia adelante. En evaluaciones realizadas junto a socios del sector privado y gubernamental, el modelo queda por detr\u00e1s de Mythos 5 tanto en investigaci\u00f3n biol\u00f3gica como en ciberseguridad ofensiva. Un dato interesante es la distinci\u00f3n que hace Anthropic dentro del propio terreno cibern\u00e9tico: Opus 5 se acerca bastante a Mythos 5 a la hora de detectar vulnerabilidades de software, pero queda mucho m\u00e1s rezagado cuando se trata de explotarlas, es decir, de convertir una falla detectada en una amenaza real. Esa brecha entre &quot;encontrar el problema&quot; y &quot;aprovecharlo&quot; es, en cierto modo, una buena noticia desde la perspectiva de seguridad.<\/p>\n<h2>Salvaguardas m\u00e1s flexibles, pero no menos cuidadosas<\/h2>\n<p>Anthropic ajust\u00f3 las barreras de protecci\u00f3n de Opus 5 respecto a las de Opus 4.8, aunque mantiene restricciones m\u00e1s estrictas en un rango acotado de tareas cibern\u00e9ticas. En t\u00e9rminos pr\u00e1cticos, el modelo puede ayudar a encontrar vulnerabilidades en c\u00f3digo fuente, pero sus clasificadores bloquean el escaneo de vulnerabilidades basado en binarios, las pruebas de penetraci\u00f3n y la generaci\u00f3n de exploits, actividades que la compa\u00f1\u00eda asocia con un mayor riesgo de uso malicioso. Seg\u00fan sus propias pruebas, esperan que estos clasificadores intervengan alrededor de un 85% menos que con Fable 5, lo que en la pr\u00e1ctica deber\u00eda traducirse en menos solicitudes leg\u00edtimas bloqueadas por error.<\/p>\n<p>Para quienes necesitan trabajar sin esas restricciones por motivos profesionales \u2014investigadores de seguridad, por ejemplo\u2014 Anthropic ofrece su Programa de Verificaci\u00f3n Cibern\u00e9tica (CVP), que da acceso a una versi\u00f3n de Opus 5 con menos limitaciones. En el plano de la biolog\u00eda, al compartir el mismo esquema de salvaguardas que Opus 4.8, se convierte en el modelo de disponibilidad general m\u00e1s capaz para investigaci\u00f3n cient\u00edfica, aunque la compa\u00f1\u00eda es clara en se\u00f1alar que todav\u00eda muestra limitaciones importantes en tareas de investigaci\u00f3n aut\u00f3nomas y de larga duraci\u00f3n, justamente donde ubican el mayor riesgo potencial. Mythos 5 sigue siendo, seg\u00fan Anthropic, el modelo m\u00e1s fuerte para ese tipo de trabajo biol\u00f3gico.<\/p>\n<h2>Precio, velocidad y novedades para desarrolladores<\/h2>\n<p>Claude Opus 5 mantiene el mismo esquema de precios que su antecesor: 5 d\u00f3lares por mill\u00f3n de tokens de entrada y 25 d\u00f3lares por mill\u00f3n de tokens de salida. Los desarrolladores ya pueden empezar a usarlo a trav\u00e9s de la API bajo el identificador claude-opus-5. Tambi\u00e9n existe un modo Fast, que funciona alrededor de 2.5 veces m\u00e1s r\u00e1pido que la velocidad est\u00e1ndar, disponible al doble del precio base en la Plataforma de Claude o mediante cr\u00e9ditos de uso en Claude Code.<\/p>\n<p>Junto con el modelo, Anthropic lanza dos funciones en beta que apuntan directamente a la experiencia de quienes construyen productos sobre su API:<\/p>\n<ul>\n<li>Cambios de herramientas a mitad de conversaci\u00f3n: los desarrolladores pueden modificar qu\u00e9 herramientas tiene disponibles Claude durante una conversaci\u00f3n sin perder la cach\u00e9 del prompt, algo que hasta ahora obligaba a reiniciar el contexto.<\/li>\n<li>Reservas autom\u00e1ticas en la API: cuando una solicitud es marcada por los clasificadores de seguridad de Opus 5 o Fable 5, el sistema puede redirigirla autom\u00e1ticamente a otro modelo disponible en lugar de bloquearla directamente, evitando as\u00ed interrupciones innecesarias en flujos de trabajo leg\u00edtimos.<\/li>\n<\/ul>\n<p>Como con los Opus anteriores, el modelo no impone requisitos de retenci\u00f3n de datos para el acceso general, un detalle que suele pesar en las decisiones de empresas con pol\u00edticas estrictas de privacidad.<\/p>\n<h2>Qu\u00e9 significa este lanzamiento en el panorama actual<\/h2>\n<p>M\u00e1s all\u00e1 de los benchmarks, lo que este lanzamiento refleja es una tendencia que se viene consolidando en la industria de la IA: la carrera ya no es solo por el modelo m\u00e1s inteligente en abstracto, sino por el que ofrece la mejor inteligencia por d\u00f3lar gastado. Que Anthropic posicione a Opus 5 como el modelo por defecto para sus planes pagos, en lugar de reservarlo como una opci\u00f3n premium aparte, es una se\u00f1al de hacia d\u00f3nde apunta la estrategia: hacer que la capacidad de frontera sea parte de la experiencia est\u00e1ndar, no un lujo adicional. A modo de ejemplo, esto podr\u00eda traducirse en que tareas que hoy requieren varias idas y vueltas con un asistente de IA \u2014depurar un error persistente, automatizar un proceso administrativo, armar un prototipo funcional\u2014 se resuelvan en menos intentos y con menor supervisi\u00f3n humana, aunque como con cualquier herramienta de este tipo, la verificaci\u00f3n final del resultado sigue siendo responsabilidad de quien la usa.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Anthropic acaba de sumar una pieza clave a su familia de modelos: Claude Opus 5 ya &hellip; <a title=\"Claude Opus 5: el nuevo modelo de Anthropic apunta a la inteligencia de frontera a mitad de precio\" class=\"hm-read-more\" href=\"https:\/\/jeffsantillan.com\/blog\/claude-opus-5-el-nuevo-modelo-de-anthropic-apunta-a-la-inteligencia-de-frontera-a-mitad-de-precio\/\"><span class=\"screen-reader-text\">Claude Opus 5: el nuevo modelo de Anthropic apunta a la inteligencia de frontera a mitad de precio<\/span>Leer m\u00e1s<\/a><\/p>\n","protected":false},"author":2,"featured_media":431,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[110,111,112],"tags":[114,118,119,9,122,121,113,115,117,116,120],"class_list":["post-424","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-inteligencia-artificial","category-lanzamientos-de-producto","category-modelos-de-lenguaje","tag-anthropic","tag-benchmarks","tag-ciberseguridad","tag-claude","tag-claude-api","tag-claude-code","tag-claude-opus-5","tag-ia-generativa","tag-llm","tag-modelos-de-lenguaje","tag-seguridad-ia"],"_links":{"self":[{"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/posts\/424","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/comments?post=424"}],"version-history":[{"count":3,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/posts\/424\/revisions"}],"predecessor-version":[{"id":427,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/posts\/424\/revisions\/427"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/media\/431"}],"wp:attachment":[{"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/media?parent=424"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/categories?post=424"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/jeffsantillan.com\/blog\/wp-json\/wp\/v2\/tags?post=424"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}