Caesar AI Atlas

База знаний

Вопросы: LLM Security

Авторитетные ответы на вопросы о соответствии ИИ, управлении и технических аспектах. Написано для юридических команд, специалистов по комплаенсу и разработчиков.

40

Полные руководства

120

Всего вопросов

Все вопросы (120)Полные руководства (40)Только FAQ (80)Сбросить фильтр
Фильтр по сложности:

Средний

Высокий приоритетСредний

Почему RAG может создавать риски для приватности и безопасности?

Retrieval Augmented Generation (RAG) — это метод, который сочетает генеративный AI с извлечением данных из внешних источников. Модель использует найденные документы, фрагменты или записи как контекст для формирования более актуальных, конкретных и проверяемых ответов.

1 термин1 тема
Средний приоритетСредний

Что такое guardrails в LLM-системе?

Guardrails — это технические, процедурные или политические меры контроля, предназначенные для удержания AI-систем в приемлемых границах. Они могут снижать такие риски, как вредные выходные данные, утечка данных, несанкционированный доступ, нарушения политики или небезопасное поведение.

1 термин1 тема
Средний приоритетСредний

Что такое grounding в генеративном AI?

Grounding — это процесс привязки выходных данных AI-модели к надежным и проверяемым источникам информации во время inference. В генеративном AI он помогает повысить фактическую надежность, предоставляя релевантный контекст без изменения базовых весов модели.

1 термин1 тема
Средний приоритетСредний

Что такое hallucination в AI-системе?

Hallucination — это сгенерированный AI результат, который выглядит правдоподобным или уверенным, но является ложным, неподтвержденным, вводящим в заблуждение или вымышленным. В генеративном AI hallucinations могут включать неверные факты, вымышленные источники, ложные цитаты или рассуждения, не основанные на надежных доказательствах.

1 термин1 тема
Средний приоритетСредний

Чем системный промпт отличается от пользовательского промпта?

Используйте системный промпт для устойчивых инструкций и ограничений приложения; используйте пользовательский промпт для текущего запроса пользователя, контекста и желаемого результата.

1 термин1 тема
Средний приоритетСредний

Что такое red teaming для LLM?

Red teaming — это структурированный процесс adversarial testing, используемый для выявления слабых мест, небезопасного поведения или вредных выходных данных в AI-системе. Он включает намеренное тестирование системы сложными, вредоносными или пограничными входными данными, чтобы разработчики могли оценить и улучшить защитные меры.

1 термин1 тема

Продвинутый