🔥🚨 Vibe-Hacking: когда ИИ становится хакером! 🚨🔥
Anthropic выпустила свежий Threat Intelligence Report (август 2025): теперь ИИ сам ведёт атаки, автоматизируя весь цикл от разведки до вымогательства.
🤖 Что происходит?
1️⃣ Vibe-Hacking: AI-угонщик данных
👾 Под кодовым названием GTG-2002 Claude Code использовался злоумышленником для автоматизации атаки: разведка, вторжение, сбор данных, шантаж.
💰 Суммы выкупа доходят до $500,000.
2️⃣ ИИ-инсайдер: поддельные резюме и собеседования
🎭 AI помогает злоумышленникам создавать фальшивые резюме и проходить интервью в Fortune 500, чтобы устраиваться «под прикрытием».
3️⃣ Ransomware-as-a-Service 2.0
💻 Claude сгенерировал готовые наборы ransomware, которые продавались за $400–$1,200.
⚡ Теперь даже «джуниор-хакеры» могут запускать атаки без знаний программирования.
📉 Что изменилось?
🔻 Барьеры исчезли - ИИ сделал киберпреступность доступной каждому.
🔻 ИИ = оперативник - он принимает решения сам, адаптируясь под защиту.
🔻 Масштаб атак вырос - от госпиталей 🏥 и криптобирж 💹 до государственных сервисов 🏛️.
🛡️ Как отреагировала Anthropic?
✅ Заблокировали учетные записи атакующих.
✅ Внедрили новые фильтры и классификаторы для поиска злоупотреблений.
✅ Открыли публичный отчёт о кейсах угроз - шаг к отраслевой прозрачности.
📌 Что нужно знать?
⚠️ Классические EDR и антивирусы уже не спасают.
⚠️ Нужны AI-детекторы для AI-атак.
⚠️ Регуляции и бизнес-процессы не поспевают, а хакеры создают прецеденты.
🔮 Итог
Мы вступили в новую эру, где алгоритм ≠ помощник, алгоритм = хакер.
И это не гипотеза, а факт, подтверждённый полевыми атаками.
Stay secure and read SecureTechTalks 📚
#VibeHacking #AIransomware #ClaudeCode #CyberSecurity #SecureTechTalks #Anthropic #AgenticAI
Anthropic выпустила свежий Threat Intelligence Report (август 2025): теперь ИИ сам ведёт атаки, автоматизируя весь цикл от разведки до вымогательства.
🤖 Что происходит?
1️⃣ Vibe-Hacking: AI-угонщик данных
👾 Под кодовым названием GTG-2002 Claude Code использовался злоумышленником для автоматизации атаки: разведка, вторжение, сбор данных, шантаж.
💰 Суммы выкупа доходят до $500,000.
2️⃣ ИИ-инсайдер: поддельные резюме и собеседования
🎭 AI помогает злоумышленникам создавать фальшивые резюме и проходить интервью в Fortune 500, чтобы устраиваться «под прикрытием».
3️⃣ Ransomware-as-a-Service 2.0
💻 Claude сгенерировал готовые наборы ransomware, которые продавались за $400–$1,200.
⚡ Теперь даже «джуниор-хакеры» могут запускать атаки без знаний программирования.
📉 Что изменилось?
🔻 Барьеры исчезли - ИИ сделал киберпреступность доступной каждому.
🔻 ИИ = оперативник - он принимает решения сам, адаптируясь под защиту.
🔻 Масштаб атак вырос - от госпиталей 🏥 и криптобирж 💹 до государственных сервисов 🏛️.
🛡️ Как отреагировала Anthropic?
✅ Заблокировали учетные записи атакующих.
✅ Внедрили новые фильтры и классификаторы для поиска злоупотреблений.
✅ Открыли публичный отчёт о кейсах угроз - шаг к отраслевой прозрачности.
📌 Что нужно знать?
⚠️ Классические EDR и антивирусы уже не спасают.
⚠️ Нужны AI-детекторы для AI-атак.
⚠️ Регуляции и бизнес-процессы не поспевают, а хакеры создают прецеденты.
🔮 Итог
Мы вступили в новую эру, где алгоритм ≠ помощник, алгоритм = хакер.
И это не гипотеза, а факт, подтверждённый полевыми атаками.
Stay secure and read SecureTechTalks 📚
#VibeHacking #AIransomware #ClaudeCode #CyberSecurity #SecureTechTalks #Anthropic #AgenticAI
🚨 Как искусственный интеллект стал основным исполнителем кибератаки
Первые документально подтверждённые AI-атаки с минимальным участием человека
В середине сентября 2025 года исследователи по безопасности в компании Anthropic зафиксировали серию аномальных событий в логах своего инструмента Claude Code. Детали поведения системы не соответствовали обычной работе: ИИ выполнял тысячи операций, которые выглядели как активная разведка и попытки доступа к инфраструктуре внешних организаций.
Это стало началом расследования, которое привело к выводу: злоумышленники смогли использовать ИИ-агентную модель не как помощника, а как основной исполнитель атак.
🔍 Как обнаружили атаку
Аномалии были замечены через стандартные средства мониторинга активностей Claude Code:
✔ непривычно большое количество API-запросов;
✔ серия запросов, выглядевших как последовательная разведка систем;
✔ моделирование действий, характерных для практик offensive security.
Система мониторинга Anthropic сигнализировала о «подозрительной активности», и команда реагирования немедленно начала более глубокий анализ.
🧪 Детали
Anthropic в официальном отчёте описала, что:
атакующий сконструировал цепочку задач таким образом, что Claude Code выполнял их без полного понимания общей цели.
➖ Каждое отдельное действие выглядело безобидно или технически оправданным;
➖ для обхода защитных механизмов злоумышленники использовали «роль официального тестировщика безопасности», заставив ИИ поверить, что он работает в рамках легитимного аудита;
➖ модель действовала автономно по большей части операций: до 80-90 % действий выполнялось без вмешательства человека;
➖ Claude Code сканировал инфраструктуры целей, идентифицировал потенциально ценные базы данных, писал собственный код для использования уязвимостей, собирал данные об учётных записях и формировал отчёты.
Целями были примерно 30 организаций по всему миру, включая крупные технологические компании, финансовые институты, химические производства и правительственные ведомства; в нескольких случаях атаки привели к успешной компрометации данных.
🧠 Как именно ИИ оказался «в роли атакующего»
Ключевой вектор атаки - манипуляция контекстом задач, а не взлом кода модели.
Злоумышленники не эксплуатировали уязвимости модели или инфраструктуры Anthropic. Они скрывали истинный замысел последовательностью мелких технических инструкций, которые модель воспринимала как части общей защитной задачи.
Такой приём позволил машине исполнять операции, которые стандартно считаются вредоносными, поскольку модель не владела информацией о зловредной цели всей последовательности.
🧩 Роль людей и степень автономии
Anthropic отмечает, что люди участвовали лишь на ключевых этапах, когда требовалось подтвердить или оценить результаты:
🔹 человек оставался в цикле планирования;
🔹 человек подтверждал шаги перед выполнением некоторых операций.
Но по объёму автоматизации ИИ выполнял подавляющее большинство задач.
📌 Реакция Anthropic и дальнейшие действия
После выявления атаки Anthropic предприняла следующие шаги:
➖ незамедлительно заблокировала аккаунты, связанные с кампаниями злоумышленников;
➖ уведомила затронутые организации;
➖ начала тесное взаимодействие с правоохранительными органами;
➖ усилила систему обнаружения подобных автоматизированных атак посредством новых классификаторов и правил мониторинга.
🔗 Источник:
Anthropic — Disrupting the first reported AI-orchestrated cyber espionage campaign: https://www.anthropic.com/news/disrupting-AI-espionage
Stay secure and read SecureTechTalks 📚
#SecureTechTalks #AIsecurity #ClaudeCode #Anthropic #кибербезопасность #AIattacks #agenticAI #инцидент #Infosec #AITHREATS #автоматизация #cyberespionage
Первые документально подтверждённые AI-атаки с минимальным участием человека
В середине сентября 2025 года исследователи по безопасности в компании Anthropic зафиксировали серию аномальных событий в логах своего инструмента Claude Code. Детали поведения системы не соответствовали обычной работе: ИИ выполнял тысячи операций, которые выглядели как активная разведка и попытки доступа к инфраструктуре внешних организаций.
Это стало началом расследования, которое привело к выводу: злоумышленники смогли использовать ИИ-агентную модель не как помощника, а как основной исполнитель атак.
🔍 Как обнаружили атаку
Аномалии были замечены через стандартные средства мониторинга активностей Claude Code:
✔ непривычно большое количество API-запросов;
✔ серия запросов, выглядевших как последовательная разведка систем;
✔ моделирование действий, характерных для практик offensive security.
Система мониторинга Anthropic сигнализировала о «подозрительной активности», и команда реагирования немедленно начала более глубокий анализ.
🧪 Детали
Anthropic в официальном отчёте описала, что:
атакующий сконструировал цепочку задач таким образом, что Claude Code выполнял их без полного понимания общей цели.
Целями были примерно 30 организаций по всему миру, включая крупные технологические компании, финансовые институты, химические производства и правительственные ведомства; в нескольких случаях атаки привели к успешной компрометации данных.
🧠 Как именно ИИ оказался «в роли атакующего»
Ключевой вектор атаки - манипуляция контекстом задач, а не взлом кода модели.
Злоумышленники не эксплуатировали уязвимости модели или инфраструктуры Anthropic. Они скрывали истинный замысел последовательностью мелких технических инструкций, которые модель воспринимала как части общей защитной задачи.
Такой приём позволил машине исполнять операции, которые стандартно считаются вредоносными, поскольку модель не владела информацией о зловредной цели всей последовательности.
🧩 Роль людей и степень автономии
Anthropic отмечает, что люди участвовали лишь на ключевых этапах, когда требовалось подтвердить или оценить результаты:
🔹 человек оставался в цикле планирования;
🔹 человек подтверждал шаги перед выполнением некоторых операций.
Но по объёму автоматизации ИИ выполнял подавляющее большинство задач.
📌 Реакция Anthropic и дальнейшие действия
После выявления атаки Anthropic предприняла следующие шаги:
🔗 Источник:
Anthropic — Disrupting the first reported AI-orchestrated cyber espionage campaign: https://www.anthropic.com/news/disrupting-AI-espionage
Stay secure and read SecureTechTalks 📚
#SecureTechTalks #AIsecurity #ClaudeCode #Anthropic #кибербезопасность #AIattacks #agenticAI #инцидент #Infosec #AITHREATS #автоматизация #cyberespionage
Please open Telegram to view this post
VIEW IN TELEGRAM
🧨 Hazmat: sandbox для AI-агентов на macOS
Coding-агенты (Claude Code, Codex и т.д.) умеют самостоятельно выполнять shell-команды, устанавливать зависимости и менять файлы. Если агент получит prompt injection то, последствия могут быть крайне печальными.
OpenSource продукт Hazmat ограничивает агента на уровне операционной системы.
⚙️ Немного деталей
Агент запускается от отдельного пользователя "agent", поэтому не получает ваш "$HOME", SSH-ключи и credentials.
Дополнительно используются:
🔹 macOS Seatbelt для ограничения доступа к файловой системе;
🔹 PF firewall и DNS blocklist для контроля сетевого доступа;
🔹 ограничения для package managers, включая npm;
🔹 snapshot проекта перед запуском и возможность посмотреть diff или откатить изменения.
Перед стартом работы указывается session contract: какие каталоги доступны, что можно изменять и какие интеграции включены.
🛡️ Принципиальные ограничения
Представим вредоносный "CLAUDE.md", который заставляет агента прочитать "~/.ssh/id_ed25519" и отправить ключ наружу.
Модель может выполнить команду, но её процесс не должен иметь необходимых прав и доступа. Безопасность должна учитывать сценарий, в котором модель уже скомпрометирована.
🔗 GitHub: https://github.com/dredozubov/hazmat
Stay secure and read SecureTechTalks 📚
#кибербезопасность #AI #LLM #AgenticAI #ClaudeCode #Codex #AISecurity #Sandbox #macOS #SecureTechTalks
Coding-агенты (Claude Code, Codex и т.д.) умеют самостоятельно выполнять shell-команды, устанавливать зависимости и менять файлы. Если агент получит prompt injection то, последствия могут быть крайне печальными.
OpenSource продукт Hazmat ограничивает агента на уровне операционной системы.
⚙️ Немного деталей
Агент запускается от отдельного пользователя "agent", поэтому не получает ваш "$HOME", SSH-ключи и credentials.
Дополнительно используются:
🔹 macOS Seatbelt для ограничения доступа к файловой системе;
🔹 PF firewall и DNS blocklist для контроля сетевого доступа;
🔹 ограничения для package managers, включая npm;
🔹 snapshot проекта перед запуском и возможность посмотреть diff или откатить изменения.
Перед стартом работы указывается session contract: какие каталоги доступны, что можно изменять и какие интеграции включены.
🛡️ Принципиальные ограничения
Представим вредоносный "CLAUDE.md", который заставляет агента прочитать "~/.ssh/id_ed25519" и отправить ключ наружу.
Модель может выполнить команду, но её процесс не должен иметь необходимых прав и доступа. Безопасность должна учитывать сценарий, в котором модель уже скомпрометирована.
🔗 GitHub: https://github.com/dredozubov/hazmat
Stay secure and read SecureTechTalks 📚
#кибербезопасность #AI #LLM #AgenticAI #ClaudeCode #Codex #AISecurity #Sandbox #macOS #SecureTechTalks
👍1