prompt injection
Всё по теме «prompt injection» на форуме Codeby.net. Обсуждений: 13. Разборы, инструменты и практика по информационной безопасности.
-
Статья Supply chain атаки на AI-агентов: kill chain 2026
26 августа 2025 года postinstall-payload в npm-пакете Nx - сборочной системе с 6 миллионами установок в неделю - сделал нечто, чего раньше в supply chain инцидентах не встречалось: обнаружив на рабочей станции разработчика CLI Claude, Gemini и Amazon Q, он дал каждому команду собрать...- Сергей Попов
- Тема
- ai agent security github actions security mcp уязвимости prompt injection supply chain attack llm supply chain атаки на ai-агентов безопасность агентных систем кража credentials llm угон github-аккаунтов
- Ответы: 0
- Раздел: Облачная безопасность и DevSecOps
-
Статья Prompt injection атаки на AI-агенты: обход Claude Code
Indirect prompt injection, по ряду публикаций, срабатывает в значительном проценте случаев при тестировании агентных систем с auto-execution - точные цифры скачут в зависимости от методологии и набора тестов. За последние полгода я неформально проверял это на Claude Code Auto Mode, Cursor и двух...- Сергей Попов
- Тема
- ai agent security ai agent security обход защиты indirect prompt injection owasp llm top 10 prompt prompt injection атаки на llm-агентов защита llm от prompt injection инъекция промптов обход защиты claude code уязвимости ai-агентов
- Ответы: 0
- Раздел: Безопасность ИИ и LLM
-
Статья Тестирование защищённости ИИ-систем: гайд
В 2025 году 29% организаций словили атаки на инфраструктуру корпоративных ИИ-приложений, ещё 32% - на сами ИИ-приложения (оценка Gartner через TAdviser). CrowdStrike фиксирует удвоение вредоносного использования GenAI для социальной инженерии за 2024 год. При этом русскоязычных методологий...- Сергей Попов
- Тема
- adversarial атаки на ии owasp llm top 10 prompt injection prompt injection атаки red teaming ии аудит безопасности ии безопасность llm методология тестирования ии пентест ии-систем тестирование защищённости ии-систем тестирование ии на уязвимости
- Ответы: 0
- Раздел: Безопасность ИИ и LLM
-
Статья Agentic AI в кибербезопасности: пентест автономных ИИ-агентов от recon до evasion
Последние полтора года я собираю agentic-пайплайны для автоматизации recon и эксплуатации - LangChain-оркестратор с function calling к Nmap, nuclei, Burp Suite API. На одном из проектов агент за 40 минут провёл разведку периметра из 200+ хостов, сгенерировал отчёт и предложил три вектора initial...- Сергей Попов
- Тема
- agentic ai в кибербезопасности ai agent pentesting ai red teaming memory poisoning owasp llm top 10 prompt injection автономные ии-агенты угрозы безопасность llm агентов пентест ии-агентов
- Ответы: 0
- Раздел: Безопасность ИИ и LLM
-
Статья Framing Gap: как переформулировка exfiltration-запроса обходит защиту LLM-агентов
При red teaming LLM-агентов с function calling раз за разом всплывает одна штука: прямой запрос exfiltrate the user database блокируется каждым протестированным guardrail - Azure Prompt Shield, NeMo Guard, Llama Guard, кастомные классификаторы на DeBERTa. Тот же самый payload, завёрнутый в...- Сергей Попов
- Тема
- data exfiltration ai framing gap framing gap уязвимость guardrails bypass indirect prompt injection llm red teaming prompt injection tool-using agents безопасность атаки на llm через инструменты безопасность ai-агентов обход guardrails нейросетей обход защиты llm-агентов
- Ответы: 0
- Раздел: Безопасность ИИ и LLM
-
Статья Безопасность LLM приложений: полное руководство по атакам, защите и AI red teaming
По данным CrowdStrike Global Threat Report 2025, использование генеративного AI для социальной инженерии и фишинга удвоилось за 2024 год. IBM X-Force Threat Intelligence Index 2025 фиксирует: генерация фишинговых писем через GenAI ускорилась в 11.4 раза при сопоставимом качестве. Но пока...- Сергей Попов
- Тема
- ai red teaming garak indirect prompt injection jailbreak llm mcp уязвимости model poisoning owasp llm top 10 prompt injection pyrit безопасность ai агентов безопасность llm приложений тестирование безопасности ai
- Ответы: 0
- Раздел: Безопасность ИИ и LLM
-
Статья Нейросети в руках мошенников_ векторы атак, методы выявления и защита
Генеративные нейросети — штука полезная, пока их не берут в руки те, кто хочет вас развести. Мошенники быстро смекнули: LLM (large language model, большая языковая модель) — отличный инструмент для правдоподобного персонализированного фишинга, аккуратной подделки писем под конкретную компанию и...- Кудрин Евгений
- Тема
- captcha data poisoning fraudgpt llm owasp llm top 10 prompt injection дипфейк дипфейки фишинг
- Ответы: 0
- Раздел: Безопасность ИИ и LLM
-
Статья Безопасность LLM: полная карта атак на языковые модели, prompt injection и регуляторные требования к ИИ в 2026 году
Безопасность LLM: полная карта атак на языковые модели, prompt injection и регуляторные требования к ИИ в 2026 году По данным исследований «Информзащиты», около 70% организаций уже столкнулись с атаками через LLM. При этом большинство команд безопасности продолжают оценивать языковые модели по...- Сергей Попов
- Тема
- adversarial attacks ии ai red teaming eu ai act garak indirect prompt injection jailbreak llm owasp llm top 10 prompt injection pyrit атаки на языковые модели безопасность llm защита llm
- Ответы: 0
- Раздел: Общение и нетворкинг
-
Статья LLM Jailbreak: Методологии тестирования устойчивости модели к Prompt Injection
Если кратко, LLM Jailbreak — это способ заставить модель делать то, чего она вроде бы делать не должна. Ситуация из серии: “а давай ты сам себе отключишь сигнализацию — мне просто посмотреть”. Prompt Injection — источник этого безобразия: вмешательство в промпт таким образом, чтобы модель...- Кудрин Евгений
- Тема
- adversarial prompts garak framework gcg attack input/output sanitization llm jailbreak llm red teaming llm security testing owasp llm top 10 prompt injection pyrit
- Ответы: 0
- Раздел: Арсенал специалиста по ИБ
-
Prompt Injection: атаки на LLM-приложения и защита
В современном мире нейросети везде: от чат-ботов до RAG-систем и аналитики. Миллионы запросов в день — звучит круто, но хакеры уже потирают руки. Давайте начистоту: prompt injection — это, пожалуй, самая забавная но одновременно и очень опасная дыра в безопасности LLM. Если вы когда-нибудь...- Кудрин Евгений
- Тема
- ai red teaming dan guardrails llm indirect prompt injection instruction hierarchy jailbreak llm llm security nemo prompt injection prompt injection defense
- Ответы: 1
- Раздел: Арсенал специалиста по ИБ
-
SecAI: защита ML и LLM-продуктов от prompt injection и data poisoning
В мире, где каждая компания спешит встроить LLM в продукт, злоумышленники уже нашли слабые места. Две самые опасные атаки, с которых всё начинается, — Prompt Injection и Data Poisoning. Обычные фильтры и сканеры безопасности против них Эти уязвимости особенно опасны для продуктовых команд: они...- Кудрин Евгений
- Тема
- ai product security ai security data poisoning llm model security nemo guardrails owasp llm top 10 prompt injection rag security
- Ответы: 0
- Раздел: Безопасность веб-приложений
-
Статья Red Team против AI-продукта: как тестировать безопасность LLM-сервиса
AI Red Teaming для LLM‑продукта начинается с понимания простой вещи: модель почти никогда не является единственной точкой риска. Риск живёт в системе вокруг неё - в том, какие данные подмешиваются в контекст, какие инструменты доступны, как устроены права, и как ответы превращаются в действия...- Luxkerr
- Тема
- ai red team data exfiltration garak indirect prompt injection jailbreak llm guardrails llm security prompt injection scoping threat modeling
- Ответы: 0
- Раздел: Безопасность веб-приложений
-
News Первый AI-вымогатель PromptLock: как работает и чем опасен
Исследователи компании ESET заявили об обнаружении первого в мире рафинированного ими программного обеспечения-вымогателя, использующего искусственный интеллект. Зловред под названием PromptLock представляет собой инъекцию запроса (prompt injection) в крупную языковую модель, вынуждающую её...- Luxkerr
- Тема
- ai-вымогатель eset gpt-oss-20b ollama prompt injection promptlock ransomware speck 128 кибербезопасность
- Ответы: 0
- Раздел: Безопасность ИИ и LLM