безопасность llm

  1. Сергей Попов

    Статья Bit-Flip атаки на веса LLM: как Rowhammer меняет решения модели без доступа к промпту

    Десятки перевёрнутых битов из миллиардов параметров - и accuracy модели на математических бенчмарках проседает на десятки процентных пунктов. Текст на выходе при этом остаётся грамматически корректным. Это данные из препринтов по bit-flip атакам на LLM масштаба 7B-14B (независимый факт-чек...
  2. Сергей Попов

    Статья Пентест LLM и AI-систем: от OWASP LLM Top 10 до регуляторного маппинга находок

    На проекте по тестированию банковского чат-бота, построенного на RAG-архитектуре, системный промпт и API-ключи к трём внутренним микросервисам удалось вытащить за сорок минут - через комбинацию прямой prompt injection и манипуляции контекстным окном. Ни Burp Suite, ни Nuclei, ни OWASP ZAP ничего...
  3. Кудрин Евгений

    Статья Threat Modeling для LLM-приложений: Применение STRIDE и DFD к новым угрозам

    1. Введение: LLM Threat Landscape Большие языковые модели (LLM) быстро перешли из разряда игрушек в слой реальных бизнес-процессов — от поддержки пользователей до обработки чувствительных данных. Вместе с пользой пришли и практичные риски. Прежде чем рассматривать тему подробнее, надо...
  4. Сергей Попов

    Статья Безопасность LLM: полная карта атак на языковые модели, prompt injection и регуляторные требования к ИИ в 2026 году

    По данным исследований «Информзащиты», около 70% организаций уже столкнулись с атаками через LLM. При этом большинство команд безопасности продолжают оценивать языковые модели по лекалам классических веб-приложений - ищут SQL-инъекции там, где работает совершенно иная плоскость атак. Я лично...