атаки на llm

  1. Сергей Попов

    Статья Уязвимости RAG-систем: атаки на Retrieval-Augmented Generation в корпоративных AI-решениях

    Пять документов на один целевой вопрос. Именно столько понадобилось, чтобы манипулировать ответами RAG-системы с вероятностью выше 90% - на тестовых QA-корпусах (NQ, HotpotQA, MS-MARCO). Результат из исследования PoisonedRAG (Zou et al., USENIX Security 2025, Pennsylvania State University +...
  2. samhainhf

    Статья Prompt Jailbreak vs Prompt Injection: В чем разница?

    Если вы хотя бы немного следите за миром больших языковых моделей (LLM), вы наверняка сталкивались с терминами "промпт-инъекция" (prompt injection) о которой я говорил в прошлой статье, и "джейлбрейк" (jailbreak). Их используют разработчики, исследователи, хакеры и журналисты. И очень часто...