Керована ракета за допомогою Claude: як осередок з Ємену замінив команду інженерів на Claude Code

У звіті Anthropic про зловживання, який ми уже покривали, залишився найтяжчий кейс: GTG-87001 з північного Ємену розробляв систему наведення ракет на Claude Code — з розподілом ролей між інстансами і офлайн-тулкітом, що працює без AI.

У вересневому звіті Anthropic Threat Intelligence, який ми загалом описали в окремому матеріалі, є розділ, що заслуговує окремої статті: conventional weapons. За грудень 2025 — серпень 2026 Anthropic виявила і припинила шість кейсів використання Claude для розробки озброєнь — три в Китаї, два в Росії та один у Ємені. Єменський — найдетальніше розписаний і, мабуть, найтривожніший: бо це перший публічно задокументований випадок, коли кодінг-агент використовувався як заміна інженерної команди у програмі керованих боєприпасів.

Три програми озброєнь

  • Тактична керована ракета з флайт-компʼютером класу звичайного смартфона і термінальним наведенням на фінальній фазі
  • Багатоступенева балістична ракета із заявленою цільовою дальністю понад 2000 км
  • Багатоваріантний комплект «R2000», що включає варіант із гіперзвуковим плануючим блоком (hypersonic glide vehicle)

Осередок (дизайнат GTG-87001) використовував Claude Code замість людських інженерів-розробників для створення GNC-софту — guidance, navigation and control, тобто програм, що керують і стабілізують летючий апарат. Конкретно: інтеграція відкритого автопілота на флайт-компʼютер телефонного класу, написання коду управління і позиційної оцінки, тюнінг контрольних параметрів, запуск пайплайна збирання прошивки і прогін флайт-симуляції.

Найпоказовіша деталь: актори керували кількома інстансами Claude одночасно, призначаючи кожному роль, — один писав код, інший проводив дослідження, третій ревʼював код першого. Пряма аналогія з тим, як техлід делегує роботу в малій інженерній команді.

Обходження захисту

Захисні механізми Anthropic блокували багато запитів — але не всі. Актори застосовували різні тактики обходу: приховували справжні цілі та кінцеві продукти, під які писався софт, і дробили роботу між багатьма сесіями так, щоб жодна окрема сесія не розкривала повної картини. Це класична проблема модерування на довгих багатокрокових сесіях: жоден окремий запит не виглядає як «допомога з ракетою».

Польотний тест і тулкіт, який живе без Claude

Anthropic не має доказів, що актори досягли оперативно придатного пристрою, — але боєприпаси таки підірвали: актори провели живий тест керованої ракети в Ємені. Тест, схоже, провалився — і протягом кількох годин актори повернулися до Claude, щоб розібрати, чому саме. Це ілюструє головний цикл сучасної агентної розробки: швидка ітерація помилка → діагноз → виправлення, яке раніше вимагало тижнів інженерного аналізу.

Найтривожніший елемент історії: актори вже встигли упакувати офлайн-тулкіт симуляції у самостійний виконуваний файл, який працює без Claude і без інженерних середовищ типу MATLAB. Тобто знання, здобуті з допомогою агента, скристалізувалися в інструмент, що переживає блокування акаунтів. Anthropic забанила асоційовані акаунти і поділилася інформацією з партнерами у державному та приватному секторах, але, за власним визнанням компанії, це вже не зупиняє розпочату програму.

Контекст звіту

Звіт охоплює сім сфер зловживань: кібероперації, стеження, впливові кампанії, шахрайство, біологічне зловживання, звичайні озброєння і нелегальну дистиляцію. У жодному кейсі, крім однієї дистиляції, не були задіяні новіші моделі Fable і Mythos — зловживання стосувалося Haiku, Sonnet і Opus. Паралельно з звітом Frontier Red Team Anthropic опублікувала нові оцінки: тактичне інтелект-таргетинг (знаходити людей за фрагментарними даними) і розробку звичайних озброєнь (наприклад, інжиніринг дронів для удару по рухомій цілі). Оцінки показують, що моделі послідовно прогресують у цих напрямках.

Наш попередній огляд звіту — з кейсом російського шпигунства GTG-20006 проти України — є окремим матеріалом: https://prostoai.xyz/articles/anthropic-threat-report/. Разом ці кейси формують чіткий висновок: AI обвалив барʼєр кваліфікації для дій, які раніше вимагали державних програм. Це прямий аргумент у дебатах про експортний контроль моделей і обовʼязкове звітування про інциденти — дебатах, які саме зараз йдуть у Конгресі.

Матеріал із рубрики «Безпека AI»AnthropicБезпека AICoding agents
Поділитися статтею
TelegramXLinkedIn

Читати далі