атаки на llm

Всё по теме «атаки на llm» на форуме Codeby.net. Обсуждений: 2. Разборы, инструменты и практика по информационной безопасности.
  1. Сергей Попов

    Статья Уязвимости RAG-систем: атаки на Retrieval-Augmented Generation в корпоративных AI-решениях

    Пять документов на один целевой вопрос. Именно столько понадобилось, чтобы манипулировать ответами RAG-системы с вероятностью выше 90% - на тестовых QA-корпусах (NQ, HotpotQA, MS-MARCO). Результат из исследования PoisonedRAG (Zou et al., USENIX Security 2025, Pennsylvania State University +...
  2. samhainhf

    Статья Prompt Jailbreak vs Prompt Injection: В чем разница?

    Если вы хотя бы немного следите за миром больших языковых моделей (LLM), вы наверняка сталкивались с терминами "промпт-инъекция" (prompt injection) о которой я говорил в прошлой статье, и "джейлбрейк" (jailbreak). Их используют разработчики, исследователи, хакеры и журналисты. И очень часто...