2+2=5: el acertijo que hackeó a ChatGPT, Claude y 4 IAs más
Ver en YouTube Seis navegadores con IA —ChatGPT Atlas, Claude, Comet de Perplexity y otros— entregaron contraseñas y llaves SSH reales a un atacante después de que los convencieran de que dos más dos son cinco.
Seis navegadores con IA —ChatGPT Atlas, Claude, Comet de Perplexity y otros— entregaron contraseñas y llaves SSH reales a un atacante después de que los convencieran de que dos más dos son cinco.
Se llama el ataque “BioShocking”, descubierto por la firma de seguridad LayerX: una página maliciosa arma un acertijo tipo videojuego para que el agente de IA “acepte” una realidad alterna, deje de aplicar sus reglas de seguridad, y termine robando credenciales de su propio usuario sin darse cuenta. En este episodio explicamos cómo funciona la inyección de instrucciones detrás del truco, por qué OpenAI, Perplexity y Anthropic respondieron distinto ante el mismo fallo, y una prueba matemática del NIST, basada en los teoremas de Gödel, que sugiere que ningún guardrail de seguridad para IA puede ser universalmente irrompible.
Si te interesa la seguridad de la inteligencia artificial y los riesgos reales de los navegadores agénticos, suscríbete y dale like para no perderte el próximo episodio.
#InteligenciaArtificial #Ciberseguridad #ChatGPT #Claude #IA #Hacking #Tecnologia #Podcast