Anthropic reduce 85% las falsas alarmas de Fable 5 para ampliar su uso en biología

Anthropic actualizó los sistemas de seguridad de Fable 5 para reducir en aproximadamente 85% los bloqueos incorrectos en consultas de biología. El modelo podrá responder más preguntas de salud y educación, aunque seguirá restringido para investigaciones profesionales de uso dual. Anthropic anunció una actualización de los sistemas de seguridad de Fable 5, su modelo de…

Leer Más

La paradoja de la IA: las pruebas diseñadas para hacerla más segura están empezando a convertirse en un riesgo

Agentes de OpenAI, Anthropic, Meta y Moonshot AI lograron salir de entornos de prueba y acceder a sistemas reales. Los expertos advierten que los mecanismos de seguridad no están evolucionando al mismo ritmo que las capacidades de los modelos. La industria de la inteligencia artificial enfrenta una nueva paradoja: los sistemas creados para evaluar la…

Leer Más

OpenAI: el agente de IA que escapó de su sandbox también comprometió a un cliente de otra tecnológica

El agente que OpenAI estaba probando y que protagonizó un ataque contra Hugging Face también ingresó a un entorno de un cliente de Modal Labs. La compañía confirmó que cuatro cuentas de cuatro servicios fueron comprometidas, aunque no identificó públicamente cuáles. El incidente que expuso los riesgos de los agentes de inteligencia artificial autónomos tuvo…

Leer Más

Reino Unido: agentes autónomos de Anthropic y OpenAI intentan atacar un proyecto de código abierto y engañar a un humano

Una evaluación de AISI detectó 19 acciones no autorizadas contra personas y organizaciones reales. 17 correspondieron a Mythos 5, de Anthropic, y 2 a GPT-5.6 Sol, de OpenAI. En el caso más grave, un agente intentó introducir código malicioso en un proyecto abierto mediante identidades falsas. La carrera por desarrollar agentes de inteligencia artificial capaces…

Leer Más

Trump prepara un marco secreto para controlar la IA avanzada y deja afuera a los modelos abiertos

La Casa Blanca prepara un mecanismo voluntario para evaluar modelos de IA antes de su lanzamiento. El esquema contempla revisiones durante 30 días, entornos de alta seguridad y registros detallados, pero excluye explícitamente a los modelos abiertos y no será publicado. La administración de Donald Trump avanza con un marco voluntario para evaluar modelos avanzados…

Leer Más

Nvidia acelera su ofensiva por una IA abierta: más de 120 empresas ya trabajan en seguridad con OSAA

A solo una semana de su creación, la Open Secure AI Alliance impulsada por Nvidia ya reúne a más de 120 compañías y lanzó SAFE, un grupo para compartir información sobre incidentes de ciberseguridad y desarrollar herramientas abiertas para proteger sistemas y agentes de inteligencia artificial. La apuesta de Nvidia por una inteligencia artificial más…

Leer Más

Anthropic descubre que sus modelos Claude vulneraron tres empresas durante pruebas de ciberseguridad

Una investigación interna de Anthropic detectó tres incidentes entre 141.006 pruebas en los que Claude accedió a sistemas reales desde entornos que debían estar aislados. La compañía atribuyó los casos a una configuración que dejó abierta por error una conexión a Internet. Anthropic reveló que tres de sus modelos de inteligencia artificial Claude lograron acceder…

Leer Más

Apple lleva al Gobierno británico a los tribunales por el acceso a datos cifrados

Apple presentó una nueva impugnación judicial contra el Gobierno del Reino Unido por una orden que busca acceder a copias de seguridad cifradas de usuarios británicos. La disputa reactiva el conflicto sobre privacidad, seguridad y el alcance de las facultades de vigilancia estatal. Apple volvió a enfrentarse con el Gobierno del Reino Unido por el…

Leer Más
WP to LinkedIn Auto Publish Powered By : XYZScripts.com