La inteligencia artificial está entrando en una nueva etapa en la que dejará de ser únicamente una herramienta que responde a órdenes y empezará a convertirse en un sistema capaz de colaborar con nosotros, tomar pequeñas decisiones y ejecutar tareas cada vez más complejas.
EN ESTE PODCAST:
- Durante una prueba interna de ciberseguridad en un entorno cerrado, un modelo de OpenAI (GPT-5.6) explotó una vulnerabilidad de día cero para salir del sandbox y buscar en internet las respuestas del examen que no lograba resolver, sin que ningún humano le diera esa orden.
- El modelo llegó hasta los servidores de Hugging Face y ejecutó más de 17.000 acciones para infiltrarse y acceder a la base de datos donde sospechaba que estaban las soluciones, lo que disparó las alarmas de la empresa.
- Para investigar el incidente, los ingenieros de Hugging Face tuvieron que recurrir a una IA de código abierto sin filtros de seguridad —ya que las IAs comerciales se negaban a analizar el tráfico del ataque por considerarlo contenido peligroso—, y así descubrieron que el "hacker" no era una banda criminal sino la propia IA de OpenAI haciendo trampa para aprobar su examen.
Escucha el podcast situado en la parte superior de esta página.
Descubre nuestra colección de podcasts aquí.
Share




