Caesar AI Atlas

База знаний

Вопросы: LLM Security

Авторитетные ответы на вопросы о соответствии ИИ, управлении и технических аспектах. Написано для юридических команд, специалистов по комплаенсу и разработчиков.

40

Полные руководства

120

Всего вопросов

Все вопросы (120)Полные руководства (40)Только FAQ (80)Сбросить фильтр
Фильтр по сложности:

Начальный

Высокий приоритетНачальный

Что такое LLM security?

LLM, или large language model, — это языковая модель с большим числом параметров, обученная на широких текстовых или мультимодальных данных для понимания и генерации языка.

1 термин1 тема
Высокий приоритетНачальный

Что такое prompt injection?

Prompt injection — это состязательный приём, при котором языковую модель заставляют следовать вредоносным или непредусмотренным инструкциям, помещённым во ввод пользователя, документы, веб-страницы или другой обрабатываемый контент.

1 термин1 тема
Высокий приоритетНачальный

Что такое jailbreak в LLM-системе?

Prompt injection или jailbreak означает состязательный ввод, предназначенный для обхода инструкций модели, safety-политик или операционных мер контроля. Меры снижения риска включают фильтрацию ввода, изоляцию retrieval-слоя, доступ инструментов по принципу минимальных привилегий, enforcement политик и многоуровневые guardrails.

1 термин1 тема
Высокий приоритетНачальный

Чем RAG отличается от fine-tuning?

Используйте RAG, когда модели нужна актуальная, основанная на источниках информация; используйте fine-tuning, когда модели нужно специализированное поведение, выполнение задач, адаптация к домену или стиль, усвоенный из данных.

1 термин1 тема

Средний

Высокий приоритетСредний

Почему RAG может создавать риски для приватности и безопасности?

Retrieval Augmented Generation (RAG) — это метод, который сочетает генеративный AI с извлечением данных из внешних источников. Модель использует найденные документы, фрагменты или записи как контекст для формирования более актуальных, конкретных и проверяемых ответов.

1 термин1 тема
Средний приоритетСредний

Что такое guardrails в LLM-системе?

Guardrails — это технические, процедурные или политические меры контроля, предназначенные для удержания AI-систем в приемлемых границах. Они могут снижать такие риски, как вредные выходные данные, утечка данных, несанкционированный доступ, нарушения политики или небезопасное поведение.

1 термин1 тема
Средний приоритетСредний

Что такое grounding в генеративном AI?

Grounding — это процесс привязки выходных данных AI-модели к надежным и проверяемым источникам информации во время inference. В генеративном AI он помогает повысить фактическую надежность, предоставляя релевантный контекст без изменения базовых весов модели.

1 термин1 тема
Средний приоритетСредний

Что такое hallucination в AI-системе?

Hallucination — это сгенерированный AI результат, который выглядит правдоподобным или уверенным, но является ложным, неподтвержденным, вводящим в заблуждение или вымышленным. В генеративном AI hallucinations могут включать неверные факты, вымышленные источники, ложные цитаты или рассуждения, не основанные на надежных доказательствах.

1 термин1 тема
Средний приоритетСредний

Чем системный промпт отличается от пользовательского промпта?

Используйте системный промпт для устойчивых инструкций и ограничений приложения; используйте пользовательский промпт для текущего запроса пользователя, контекста и желаемого результата.

1 термин1 тема
Средний приоритетСредний

Что такое red teaming для LLM?

Red teaming — это структурированный процесс adversarial testing, используемый для выявления слабых мест, небезопасного поведения или вредных выходных данных в AI-системе. Он включает намеренное тестирование системы сложными, вредоносными или пограничными входными данными, чтобы разработчики могли оценить и улучшить защитные меры.

1 термин1 тема

Продвинутый