Anfänger
Was ist LLM-Sicherheit?
LLM-Sicherheit ist die Disziplin, Anwendungen mit großen Sprachmodellen vor Angriffen, Missbrauch, Datenabfluss, unsicheren Ausgaben und unbeabsichtigten Handlungen zu schützen.
Was ist Prompt Injection?
Prompt Injection ist eine adversariale Technik, bei der ein Sprachmodell durch bösartige oder unbeabsichtigte Anweisungen in Nutzereingaben, Dokumenten, Webseiten oder anderen verarbeiteten Inhalten manipuliert wird.
Was ist ein Jailbreak in einem LLM-System?
Prompt Injection oder Jailbreak bezeichnet adversariale Eingaben, die darauf abzielen, Anweisungen, Sicherheitsrichtlinien oder operative Kontrollen eines Modells zu umgehen. Gegenmaßnahmen umfassen Eingabefilterung, Retrieval-Isolation, Tool-Zugriff nach dem Least-Privilege-Prinzip, Richtliniendurchsetzung und mehrschichtige Guardrails.
Wie unterscheidet sich RAG von Fine-Tuning?
Verwenden Sie RAG, wenn das Modell aktuelle, quellenbasierte Informationen benötigt; verwenden Sie Fine-Tuning, wenn das Modell spezialisiertes Verhalten, Aufgabenleistung, Domänenanpassung oder einen aus Daten erlernten Stil benötigt.