Saltar al contenido

Referencia técnica

Amenazas a LLMs

Un catálogo de ataques a modelos de lenguaje y sistemas RAG, con los mecanismos que Aegis proporciona para detectarlos sin garantizar prevención total.

Los ataques a LLMs incluyen inyección de prompts, extracción de datos sensibles, manipulación de contexto RAG y envenenamiento de datos de entrenamiento.

Aegis proporciona detectores para varios de estos vectores, pero no garantiza prevención universal: los límites se declaran explícitamente.

  • LLM
  • inyección de prompts
  • RAG
  • amenaza
  • WAF