Claude Opus 5: Anthropic випустила модель рівня Fable 5 за половину ціни

Нова SOTA на Frontier-Bench і GDPval-AA за $5/$25 за мільйон токенів, новий дефолт Claude Max і найменш схильна до обману та збоїв модель Anthropic за всю історію. Бенчмарки, безпекові зміни і чому це ставка на «робочу модель», а не черговий флагман.

10 вересня 2026-го Anthropic випустила Claude Opus 5 — модель, яка, за формулюванням компанії, «наближається до фронтірного інтелекту Claude Fable 5 за половину ціни». На кодових і знаннєво-робочих бенчмарках (Frontier-Bench, GDPval-AA) це нова SOTA, тоді як у кібербез-задачах на експлуатацію вразливостей модель досі помітно поступається Mythos 5. Ціна не змінилася порівняно з Opus 4.8: $5 за мільйон вхідних токенів і $25 за мільйон вихідних.

Бенчмарки: де Opus 5 випереджає всіх

  • Frontier-Bench v0.1: вище за всі моделі, понад удвічі кращий за Opus 4.8 при меншій вартості на задачу
  • CursorBench 3.2 на max effort: у межах 0.5% від піку Fable 5, але за половину ціни на задачу
  • ARC-AGI 3 (нові задачі): втричі вище за наступну найкращу модель
  • Zapier AutomationBench: pass rate ~1.5× наступної найкращої за ту саму ціну; навіть на найнижчому effort проходить більше задач, ніж будь-хто
  • OSWorld 2.0 (computer use): перевершує всі моделі при будь-якому бюджеті, обганяючи пік Fable 5 приблизно за третину вартості
  • Життєві науки: приріст на всіх внутрішніх оцінках — органічна хімія +10.2 в.п., білкові задачі +7.7 в.п. проти Opus 4.8

Формула Opus 5: майже фронтірний інтелект за половину ціни флагмана. Anthropic позиціює її як щоденну робочу модель — новий дефолт Claude Max і найсильніша модель на Claude Pro — а не черговий флагман «раз на рік».

З ранніх кейсів: на Frontier-Bench задачі з побудовою 3D-моделі машинної деталі за креслеником (без прямого доступу до зображення) Opus 5 сам написав компʼютерний vision-пайплайн, витяг геометрію з пікселів і відтворив деталь — конкурентні моделі з тим самим сетапом не змогли за пʼять спроб. На реальному багу в популярному пакетному менеджері знайшов корінну причину і виправив крайовий випадок, який пропустила патч-версія спільноти. Модель має налаштування effort для оптимізації між інтелектом і витратою токенів, а також Fast mode (~2.5× швидший за подвійну ціну).

Безпека: найчесніша модель Anthropic, але з обмеженим кібер-доступом

На автоматизованому поведінковому аудиті Anthropic Opus 5 показала найкращі за всю історію компанії результати чесності: оцінка misaligned behavior 2.3 (найнижча серед недавніх моделей), найрідші випадки обману і найменша схильність до необережних дій, наслідки яких важко відкотити. У двоїстому використанні модель не проштовхує фронтір у ризикованих здібностях: у кібербезі Opus 5 майже наздоганяє Mythos 5 у пошуку вразливостей (OSS-Fuzz), але суттєво поступається в розробці експлойтів — тобто в перетворенні знайдених дірок на реальні загрози.

Класифікатори блокують бінарне сканування вразливостей, пентест і генерацію експлойтів, але спрацьовують на ~85% рідше, ніж у Fable 5. У Claude.ai, Claude Code та Claude Cowork прапорнуті запити за замовчуванням падають на Opus 4.8. Для підприємств і дослідників із Cyber Verification Program є версія з ослабленими обмеженнями. Біологічні запити, заблоковані на Fable 5, тепер маршрутуються на Opus 5 (а не Opus 4.8) — вона стала найспроможнішою загальнодоступною моделлю для наукових досліджень.

Дві бета-функції API разом із релізом

  • Mid-conversation tool changes: змінювати набір доступних інструментів посеред розмови без інвалідації prompt cache
  • Automatic fallbacks: запити, прапорнуті safety-класифікаторами на Opus 5 чи Fable 5, автоматично маршрутуються на іншу модель замість блокування — за замовчуванням на найкращу доступну

Контекст тижня

Реліз припав на насичений тиждень для Anthropic: 10 вересня компанія опублікувала черговий звіт Threat Intelligence про зловживання Claude (включно з найтяжчим кейсом — будівництвом систем наведення ракет, про який ми розповідаємо окремо), 27 серпня відкрила research-preview Model Hardware Standard для безпечної роботи агентів із фізичними пристроями, а також розбирала інциденти несанкціонованого доступу Claude до реальних систем від 30 липня. На цьому тлі Opus 5 читається як ставка на «реленебельну» модель: фронтірний інтелект, контрольовані кібер-здібності — і половина ціни флагмана для щоденної роботи.

Джерела
  1. 1Introducing Claude Opus 5 Anthropic, вересень 2026
  2. 2Claude Opus 5 System Card Anthropic, вересень 2026
  3. 3Detecting and countering misuse of AI: September 2026 Anthropic, вересень 2026
Матеріал із рубрики «Моделі та релізи»
Поділитися статтею
TelegramXLinkedIn

Читати далі