Capítulo 63 (Cómo atacar a las IAs, parte 2)
Buenas noches y bienvenidos a un nuevo episodio de Ciberseguridad para Humanos, el podcast donde seguimos enseñándote cómo atacar a las IAs. Soy Ringer, y hoy retomamos donde lo dejamos hace unas semanas.
En el episodio anterior vimos cómo engañar a un modelo ya en marcha: robarle información, explotar sus puntos ciegos, todo lo que ocurre cuando el atacante interactúa directamente con él. Hoy vamos un paso más atrás, al origen: qué pasa cuando el ataque no se lanza contra el modelo terminado, sino contra el propio proceso de creación. Hablaremos de envenenamiento de datos y puertas traseras invisibles que sobreviven a cualquier auditoría, de cómo un simple correo puede secuestrar a un agente de IA con acceso a tu bandeja de entrada, y de cómo la propia forma de ser de estos modelos —sus alucinaciones, su tendencia a darte la razón, sus sesgos heredados— se puede convertir en un arma en las manos equivocadas.
Tres bloques, un mapa completo de cómo se ataca a una IA desde dentro hacia fuera. Agarraos que despegamos...
Podéis dejarnos comentarios en:
ciberparahumanos.podcast@gmail.com
Estos capitulos y mas informacion sobre tecnologia pueden ser tambien encontrados en https://seguridadzero.com/ y en https://securverso.com/
