атаки на поверхность api llm
Всё по теме «атаки на поверхность api llm» на форуме Codeby.net. Обсуждений: 1. Разборы, инструменты и практика по информационной безопасности.
-
Статья EchoCoT: извлечение цепочек рассуждений LLM из black-box reasoning-моделей через API
CoT Hijacking - атака из препринта 2025 года на arXiv - выдаёт 99% attack success rate на Gemini 2.5 Pro, 100% на Grok 3 mini и 94% на Claude 4 Sonnet (цифры из препринта, независимая верификация пока не проведена). Вектор один: длинные последовательности безобидных рассуждений перед вредоносным...- Сергей Попов
- Тема
- black-box атаки языковые модели chain-of-thought extraction cot hijacking echocot side-channel атаки lrm атаки на reasoning модели атаки на поверхность api llm безопасность llm api извлечение цепочек рассуждений llm кража скрытых рассуждений ии уязвимости reasoning моделей
- Ответы: 0
- Раздел: Безопасность ИИ и LLM