Seguridad en IA · Lección 16
¿Qué principio sigue una arquitectura de 'defensa en profundidad' aplicada a una aplicación LLM, en vez de depender de un único mecanismo de protección?
Combina múltiples capas de defensa independientes (filtrado de entrada, guardrails del modelo, filtrado de salida, monitoreo) de forma que si una capa específica falla o es evadida, las demás capas todavía ofrecen protección adicional
La defensa en profundidad consiste en tener exactamente una única capa de protección, pero implementada con el máximo nivel de rigor posible
Este enfoque elimina por completo la necesidad de tener cualquier tipo de monitoreo continuo del sistema una vez que las capas de defensa están implementadas
Solo es relevante si la aplicación tiene exactamente un único usuario consultándola en total, sin ningún volumen real de tráfico
Seguridad en IA · Lección 16
Completa el código
Si una capa específica falla, las demás capas todavía ofrecen protección
Revisa: las demás capas todavía ofrecen protección adicional complementaria.
Seguridad en IA · Lección 16
¿Por qué depender de un único mecanismo de defensa (como solo el filtrado de entrada) dejaría a la aplicación completamente expuesta si un atacante encuentra la forma específica de evadir precisamente ese único mecanismo?
Pista: si el filtrado de entrada fuera la única defensa real del sistema, un atacante que descubra una forma específica de redactar su ataque que evada ese filtro particular tendría acceso directo y sin ninguna otra barrera hacia el resto del sistema; con múltiples capas independientes, esa misma evasión del filtrado de entrada todavía tendría que superar los guardrails del modelo y el filtrado de salida antes de tener éxito completo.
✓
¡Lección completada!
Arquitectura de defensa en capas para aplicaciones LLM
0
XP ganado
3
Vidas restantes