Principiante
¿Qué es la seguridad de LLM?
La seguridad de LLM es la disciplina de proteger aplicaciones basadas en modelos de lenguaje grandes frente a ataques, uso indebido, fuga de datos, salidas inseguras y acciones no previstas.
¿Qué es la inyección de prompts?
La inyección de prompts es una técnica adversarial que manipula un modelo de lenguaje colocando instrucciones maliciosas o no previstas en entradas de usuario, documentos, páginas web u otro contenido que el modelo procesa.
¿Qué es un jailbreak en un sistema LLM?
La inyección de prompts o jailbreak se refiere a una entrada adversarial destinada a eludir las instrucciones, políticas de seguridad o controles operativos de un modelo. Las mitigaciones incluyen filtrado de entradas, aislamiento de recuperación, acceso a herramientas con privilegio mínimo, aplicación de políticas y guardrails por capas.
¿En qué se diferencia RAG del fine-tuning?
Usa RAG cuando el modelo necesita información actual, fundamentada en fuentes; usa fine-tuning cuando el modelo necesita comportamiento especializado, rendimiento en tareas, adaptación de dominio o estilo aprendido a partir de datos.