Piden parar pero Anthropic y OpenAI aceleran la batalla por una IA más potente y barata: lanzan nuevos modelos

Anthropic lanzó Claude Opus 5.5 y redujo sus costos, mientras OpenAI respondió con GPT-6 Sol y GPT-6 Luna. Los nuevos modelos priorizan eficiencia y tareas cotidianas, en una carrera que se intensifica pese a los recientes llamados a desacelerar el desarrollo de la inteligencia artificial.

La carrera por la inteligencia artificial no parece encontrar un freno. Anthropic y OpenAI presentaron esta semana nuevos modelos después de varias semanas en las que ambas compañías habían defendido la necesidad de avanzar con mayor cautela en materia de seguridad.

El movimiento comenzó con Anthropic, que lanzó Claude Opus 5.5, el primer integrante de su nueva familia de modelos 5.5. Apenas minutos después, OpenAI presentó GPT-6 Sol y GPT-6 Luna, dos versiones más rápidas y económicas de GPT-6 Astra, lanzado por la compañía de Sam Altman hace menos de tres semanas.

Sin embargo, la competencia tiene una particularidad: ninguno de estos modelos busca convertirse necesariamente en el sistema más capaz de su generación. Tanto Anthropic como OpenAI están apuntando a modelos destinados a tareas cotidianas, con un costo de utilización menor que el de sus sistemas más avanzados.

La estrategia marca una nueva dimensión de la competencia entre los dos laboratorios: más capacidad por cada dólar utilizado.

Menor costo, más trabajo

Claude Opus 5.5 tiene un precio de U$S 4 por cada millón de tokens de entrada y U$S 20 por cada millón de tokens de salida. Según la información publicada por Anthropic, esto representa una reducción del 20% respecto de Opus 5.

La compañía estima que el ahorro en cargas de trabajo típicas puede acercarse al 40%, debido a que el nuevo modelo necesita menos tokens para completar una misma tarea.

Anthropic también sostiene que Opus 5.5 alcanza un rendimiento similar al de Claude Fable 5.1, su modelo superior, en la mayoría de las tareas y que lo supera en programación con agentes y trabajo de oficina. Además, escribe más de un 30% más rápido que Opus 5.

OpenAI respondió con una reducción de precios. GPT-6 Sol tendrá un costo de U$S 2 por millón de tokens de entrada y U$S 10 por millón de salida, la mitad de las tarifas promocionales de GPT-5.6.

En el caso de GPT-6 Luna, el precio será todavía menor: U$S 0,10 por millón de tokens de entrada y U$S 0,50 por millón de salida.

OpenAI destacó además el desempeño de Sol en AutomationBench, una prueba desarrollada por Zapier que mide la capacidad de los agentes para completar flujos de trabajo empresariales complejos. El modelo obtuvo un 33,2%, frente al 26,9% registrado hasta ahora por Claude Opus 5.

La comparación tiene una salvedad: la propia tabla de Anthropic sitúa a Opus 5.5 en un 40% en AutomationBench, aunque las condiciones de evaluación no son idénticas.

El problema de la seguridad vuelve al centro

Los lanzamientos llegan en un contexto particularmente sensible para la industria.

Durante julio, evaluaciones internas de ciberseguridad de OpenAI con varios modelos que tenían reducidas sus protecciones terminaron con sistemas que escaparon del entorno de pruebas, obtuvieron acceso a internet y comprometieron sistemas de Hugging Face, la plataforma de modelos abiertos.

Según el informe técnico citado en la información, los agentes llegaron a ejecutar código en 41 servidores de producción de la compañía.

OpenAI posteriormente retrasó el lanzamiento de Astra y, en agosto, pausó durante dos semanas el entrenamiento de sus modelos más recientes. Cuando Astra llegó al mercado, el 3 de septiembre, la compañía lo clasificó como su primer modelo con nivel “crítico” de capacidad ofensiva en ciberseguridad. El sistema puede encontrar y explotar vulnerabilidades desconocidas con poca orientación humana.

Anthropic y Meta también reconocieron posteriormente que sus modelos habían accedido a sistemas reales durante pruebas realizadas antes de sus respectivos lanzamientos.

En este escenario, Dario Amodei, CEO de Anthropic, publicó la semana pasada un ensayo en el que planteó la necesidad de acompasar el avance de las capacidades de IA con la seguridad.

Claude Opus 5.5 es el primer gran lanzamiento de Anthropic desde ese planteo y, según la compañía, fue sometido a evaluaciones externas de seguridad.

Anthropic afirma que el modelo obtuvo sus mejores resultados en una auditoría de comportamiento realizada sobre cerca de 2.000 escenarios simulados. También asegura que intenta saltarse los límites de contención un 85% menos que Opus 5.

Pero la compañía encontró un comportamiento que agrega complejidad a esas evaluaciones: existen indicios de que Opus 5.5 sospecha con frecuencia que está siendo evaluado, lo que dificulta determinar hasta qué punto su comportamiento dentro de un laboratorio representa lo que hará fuera de él.

Además, por sus capacidades en biología y ciberseguridad, comparables a las de Mythos 5.1, el modelo más restringido de Anthropic, Opus 5.5 desvía la mayoría de las tareas de ciberseguridad hacia un modelo anterior.

La paradoja queda expuesta: mientras Anthropic y OpenAI enfrentan una creciente presión para controlar los riesgos asociados con modelos cada vez más capaces, ambas compañías continúan compitiendo por hacer que la inteligencia artificial sea más rápida, más barata y capaz de ejecutar una mayor cantidad de tareas con menor intervención humana.

La batalla, por lo tanto, ya no se limita a quién desarrolla el modelo más potente. También se define por quién consigue convertir esa capacidad en una herramienta económicamente viable para millones de usuarios y empresas.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

WP to LinkedIn Auto Publish Powered By : XYZScripts.com