Компанія Anthropic представила Claude Opus 5, нову модель штучного інтелекту, яка, за словами компанії, забезпечує передовий інтелект приблизно вдвічі дешевше, ніж модель Fable 5 найвищого рівня. Opus 5, випущений 24 липня 2026 року, тепер є моделлю за замовчуванням на Claude Max і найпотужнішою моделлю на Claude Pro, позиціонуючи його як повсякденну робочу конячку Anthropic для кодування, автономних агентів і професійної роботи.
Запуск відбувається в той момент, коли компанії ретельно вивчають витрати на штучний інтелект. За даними CNBC, нова модель «конкурує з Fable 5 і є дешевшою, оскільки компанії турбуються про витрати», а Bloomberg охарактеризував її як «рентабельнішу модель для повсякденних завдань». Для команд, які відстежують останні [розробки штучного інтелекту] (https://aibuzzwire.news), Opus 5 являє собою навмисну ставку на те, що наступним конкурентним полем битви є цінність, а не перевага в сирому тесті.
Порівняльна продуктивність: новий сучасний рівень кодування та роботи зі знаннями
Anthropic повідомляє, що Opus 5 публікує найсучасніші результати щодо кодування та оцінювання знань, включаючи Frontier-Bench і GDPval-AA. На Frontier-Bench v0.1, за словами компанії, Opus 5 перевершує всі інші моделі та більш ніж удвічі підвищує продуктивність свого попередника, Opus 4.8, за нижчої вартості виконання завдання.
На CursorBench 3.2 Opus 5 досягає 0,5% від максимального результату Fable 5, але коштує вдвічі менше за завдання, згідно з власними тестами Anthropic. Decrypt зазначив, що модель «перевершує Fable 5 за більшістю тестів — за половину ціни».
Переваги поширюються на агентське оцінювання та оцінювання вирішення проблем:
- ARC-AGI 3: Opus 5 отримав приблизно в три рази більше результатів, ніж наступна найкраща модель у цьому новому тесті на вирішення проблем.
- Zapier AutomationBench: Показник проходження приблизно в 1,5 рази перевищує наступну найкращу модель за таку саму вартість, вимірюючи наскрізне виконання бізнес-завдань.
- OSWorld 2.0 (використання комп’ютера): Opus 5 перевершує найкращий результат Fable 5 за трохи більше третини вартості.
Примітно, що Anthropic визнає, що Opus 5 «залишається позаду Mythos 5 щодо завдань кібербезпеки», області, де суперницька передова модель зберігає лідерство.
Сильніша агенція та самоперевірка
Тема, що повторюється в оголошенні, — покращена здатність Opus 5 перевіряти власну роботу та повторювати її, поки не досягне успіху. Anthropic описав кілька прикладів із тестування раннього доступу, які підкреслюють цю автономію.
В одному із завдань Frontier-Bench моделі дали креслення деталі машини та попросили написати код, щоб реконструювати її як 3D-модель FreeCAD, але їй навмисно не дали можливості переглядати креслення безпосередньо. Повідомляється, що Opus 5 створив власний конвеєр комп’ютерного бачення, щоб витягти геометрію з необроблених пікселів, а потім перебудував повну частину, неодноразово досягаючи успіху, коли жодна конкуруюча модель не могла вирішити завдання після п’яти спроб.
Враховуючи справжню помилку в популярному менеджері пакунків з відкритим вихідним кодом, Opus 5 знайшов першопричину та виправив граничний випадок, який пропустив власний патч спільноти, тоді як конкуруюча модель виправила лише поверхневий симптом і оголосила помилку вирішеною. Повідомляється, що інженер торгової фірми використовував Opus 5 для створення каналу ринкових даних для нової біржі за один сеанс — завдання, яке попередні моделі взагалі не могли виконати — і, не знайшовши живого каналу для перевірки, модель створила власну тестову систему.
Прийом клієнтів
Партнери з раннього доступу дали переважно позитивні оцінки. Скотт Ву, генеральний директор Cognition (виробник агента кодування Devin), сказав, що Opus 5 «наближається до продуктивності рівня Fable вдвічі дешевше» та демонструє «особливу силу у складних завданнях налагодження та аналізу першопричин». Суалех Асіф, співзасновник Cursor, сказав, що ця модель забезпечує «інтелект, близький до Fable 5, зі швидкістю та вартістю Opus».
Уейд Фостер, генеральний директор Zapier, повідомив, що Opus 5 «очолював таблицю лідерів Zapier AutomationBench, не витрачаючи більше токенів, ніж попередні моделі Claude», завершивши повний робочий процес із запобігання відтоку від кінця до кінця — позначаючи облікові записи під загрозою, сповіщаючи відповідного власника та підсумовуючи для команд утримання. Попередні моделі не проходили; Opus 5 досяг 100%.
Досягнення наукових досліджень
Anthropic також підкреслив вдосконалення Opus 5 для наукової роботи. Модель перевершує Opus 4.8 у кожному дослідженні Anthropic у сфері наук про життя, що охоплює структурну біологію, органічну хімію та біоінформатику. Компанія вказала на покращення на 10,2 відсотка у тесті внутрішньої органічної хімії (виведення молекулярних структур на основі даних спектроскопії) та приріст на 7,7 пункту у завданнях прогнозування функції білка. Один замовник геноміки описав модель так, що вона поводиться «скоріше як уважний науковець», який намагається використовувати правильні статистичні тести та перехресно перевіряти власні результати.
Стратегія ціноутворення
Встановлюючи ціну Opus 5 на тому ж рівні, що й Opus 4.8, наближаючись до рівня інтелекту Fable 5, Anthropic фактично скорочує розрив між пропозиціями середнього та флагманського рівня. VentureBeat сформулював випуск як «дешевшу модель штучного інтелекту для кодування, агентів і корпоративних робочих процесів», а Seeking Alpha зазначив, що Opus 5 «ближча й дешевша до передової моделі Fable 5». Компанія пропонує регульоване налаштування «зусиль», яке дозволяє клієнтам обмінювати інтелектуальні дані на швидкість і меншу вартість токенів, точно регулюючи співвідношення вартості та продуктивності для кожного завдання.
Що це означає для гонки ШІ
Opus 5 підкреслює, як швидко падає вартість ближнього ШІ. Модель, яка наближається до найпотужніших доступних систем — за вдвічі нижчою ціною токена — тисне на конкурентів, щоб вони виправдовували високу ціну заради незначних прибутків. У зв’язку з тим, що Anthropic, OpenAI, Google та інші змагаються, щоб зробити ефективні моделі, достатньо доступними для щоденного широкомасштабного розгортання, питання для підприємств зміщується з «яка модель найрозумніша?». до "яка модель забезпечує найбільше інтелектуальних даних за долар?"
Для Anthropic послання чітке: висококласне міркування більше не є продуктом розкоші. Opus 5 надає можливість працювати на кордоні за таку ціну, яка робить реалістичним стійке щоденне розгортання — і це може виявитися найважливішою деталлю з усіх.
Будьте попереду ШІ
Claude Opus 5 доступний сьогодні на Claude Pro, Claude Max і через API Anthropic. Щоб дізнатися більше про цю історію та ширший ландшафт штучного інтелекту, слідкуйте за найважливішими новинами AI, як це відбувається.
Читати більше новин AI →