Компанія Anthropic опублікувала детальну інженерну розповідь про те, як вона зробила claude.ai і настільну програму Claude приблизно втричі швидшими за двотижневий спринт, і головна особливість полягає в тому, що більшу частину роботи виконав сам Клод. Повідомлення, опубліковане в інженерному блозі Anthropic, описує кампанію підвищення ефективності, яка запускається з одного каналу Slack із моделлю AI у кожному потоці, знаходить вузькі місця, створює контрольні показники, покращує доставку та спостерігає за кожним розгортанням.

Цифри, виміряні на 75-му процентилі, значні. Час до друкованої сторінки під час нового завантаження claude.ai впав з 3,1 секунди до 0,55 секунди. Початок нового сеансу Claude Code скоротився з 0,8 секунди до 0,3 секунди, а завантаження хмарного сеансу Claude Cowork впав з 2,6 секунди до 0,73 секунди. Загалом, за оцінками Anthropic, удосконалення заощаджують десятки тисяч годин очікування користувачів щодня. For more context on this story, see our ongoing AI news.

Спочатку вимірювання, потім рух

Спринт почався з вимірювання, а не коду. Використовуючи Claude для аналізу даних про використання через сервер Datadog MCP, команда визначила чотири шляхи користувача, на які припадає 95 відсотків активності: запуск програми, початок бесіди, завантаження існуючої бесіди та надсилання повідомлення. У Інтернеті та на настільному комп’ютері ці подорожі розбивалися на тринадцять різних вимірювань, і команда додавала інструменти, доки кожне не стало прямо порівнюваним — починаючи від взаємодії користувача та закінчуючи після відтворення результату.

Маючи базові показники, команда склала список приблизно з двадцяти власноруч відібраних проектів, кожен з яких спрямований на конкретну подорож, і попросила Клода оцінити вплив кожного за мілісекунди, щоб встановити цілі спринту. План реалізувався завчасно: Anthropic повідомляє, що до третього дня вражено дванадцять із тринадцяти цілей. Це дало можливість Клоду визначити додаткові можливості та запропонувати нові робочі потоки, які швидко переросли у повноцінні власні проекти та вийшли за межі початкових цілей.

Що насправді було відправлено

Технічні зміни виглядають як контрольний список сучасних веб-продуктивних робіт. Для швидшого запуску команда запекла статичний редактор у HTML, щоб користувачі могли почати вводити текст під час ініціалізації React, і попередньо скомпільувала кеш коду V8, щоб основний процес оболонки робочого столу більше не компілювався з нуля під час запуску. Для швидшої навігації між бесідами композитор залишається встановленим, а не розбирається та перебудовується, сеанси попередньо завантажуються, коли користувач наводить на них курсор, а повторне рендеринг бічної панелі скорочено на 90 відсотків.

Масштаб історії злиття є головною цифрою: згідно з дописом, під час спринту було внесено понад три тисячі змін без жодного інциденту з клієнтом або відкату.

Клод Тег: агент із поручнями

Спринт проводився на тому, що Anthropic називає Claude Tag, наразі в бета-версії та описується як модель внутрішнього дослідження, приблизно порівнянна з Opus 5.5. Розподіл праці є найбільш важливою частиною історії. Клод знаходив вузькі місця, створював тести, впроваджував виправлення та відстежував кожне розгортання — працював асинхронно годинами за раз, навіть протягом ночі. Люди встановлювали цілі, йшли на компроміси та схвалювали кожну зміну перед тим, як вона злилася.

Команда також хотіла виконувати ітерацію швидше, ніж її темп розгортання, тому вона створила лабораторні вимірювання як проксі-сервери для зчитування в реальному світі. Серед питань, які поставили інженери: чи може підрахунок інструкцій JavaScript замінити відлік часу настінного годинника як швидший сигнал зворотного зв’язку для перевірки прототипів перед розгортанням?

Чому це важливо для розробки за допомогою ШІ

Публікація Anthropic примітна не стільки спеціальними оптимізаціями — статичні оболонки, попередня вибірка та зменшення рендерингу є усталеними методами, скільки тим, що вона демонструє розробку на основі ШІ у масштабі виробництва. Передова лабораторія щойно відправила оновлену продуктивність флагманського споживчого продукту з трьома тисячами змін, причому агенти штучного інтелекту виконали основну частину роботи з ідентифікації, впровадження та перевірки, а люди зберегли повноваження щодо схвалення кожної зміни.

Результат також потрапляє в конкурентний контекст, де оперативність є властивістю продукту. Claude безпосередньо конкурує з ChatGPT від OpenAI і Gemini від Google за увагу споживачів і розробників, а сприймана швидкість визначає щоденне використання продуктів-помічників так само, як і якість моделі. Скорочення часу взаємодії з 3,1 секунди до 0,55 секунди усуває одну найпоширенішу скаргу користувачів щодо продукту.

Для команд інженерів, які спостерігають ззовні, можна перенести урок з облікового запису Anthropic про структуру циклу: точно вимірювати шляхи користувачів, дозволяти моделі пропонувати та підтверджувати зміни щодо цих вимірювань, підтримувати шлюз схвалення людиною та розширювати сферу так швидко, як може перевірити система вимірювання. Власна концепція Anthropic полягає в тому, що коли Клод може щось виміряти, він може зробити це швидше — тому команда постійно знаходила більше речей для вимірювання.

Чи стануть подібні спринти, керовані агентами, стандартною практикою в індустрії програмного забезпечення, ще невідомо, але Anthropic надала одну з найбільш конкретних загальнодоступних точок даних, які можуть працювати в масштабі. Читачі, які відстежують, як ШІ змінює розробку програмного забезпечення, можуть стежити за нашими дослідженнями ШІ, щоб дізнатися про подальші розробки.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →