Anthropic розкрила, скільки досліджень ШІ вже виконує сам

Anthropic уперше опублікувала внутрішні показники автоматизації: її модель Claude уже виконує більшу частину роботи в 26% дослідницьких завдань, пов'язаних зі створенням наступних поколінь ШІ. У березні 2026 року цей показник становив лише 1%.
Компанія Anthropic оприлюднила набір внутрішніх метрик, які показують, наскільки активно штучний інтелект залучається до розробки нових моделей ШІ. За її даними, станом на серпень 2026 року Claude виконує основну частину роботи в 26% дослідницьких завдань. Ще в березні цей показник був на рівні 1%.
Для оцінювання використали шкалу автоматизації Epoch AI з шістьма рівнями — від AL0, коли ШІ не залучений до роботи, до AL5, коли модель діє повністю автономно. Повної автономності Claude не досяг у жодному з напрямів, які вимірювали. Натомість у 26% завдань він працює на рівні AL4: отримує від людини загальне завдання й виконує більшу його частину, тоді як дослідник лише наглядає. Понад 90% усіх дослідницьких завдань перебувають щонайменше на рівні AL3 — це означає, що Claude виконує значний обсяг роботи у співпраці з людиною.
Компанія також розповіла, як контролює власних агентів ШІ. На її основній внутрішній платформі працюють близько 30 тисяч агентів, і всі їхні дії проходять через систему моніторингу. Онлайн-перевірки охоплюють 100% дій ще до виконання й можуть автоматично блокувати небезпечні операції, зокрема спроби скопіювати ваги моделей із внутрішніх систем. Протягом серпня монітори проаналізували понад мільярд рішень агентів і заблокували 0,002% дій — приблизно одну з кожних 47 тисяч. Офлайн-монітори щотижня опрацьовують близько 100 тисяч стенограм роботи агентів; більшість позначених випадків відсіюють автоматичні класифікатори, а близько 50 найважливіших щотижня передають людям.
Окремо Anthropic показала розподіл обчислювальних ресурсів. За тиждень з 13 до 20 липня 2026 року близько 6% обчислень, пов'язаних із дослідженнями та розробкою ШІ, припадало на роботи з безпеки; з урахуванням ширшого набору навантажень — близько 12%. «Це навмисно занижені оцінки. Наприклад, якщо той чи інший токен використовувався для розширення можливостей у тій же мірі, що й для підвищення безпеки, його не враховували в цих показниках. Крім того, ці показники не враховують класифікатори заходів безпеки, які становлять окремий, порівнянний обсяг обчислювальних ресурсів і роблять наші моделі набагато безпечнішими для світу», — зазначили в компанії.
На думку Anthropic, такі звіти могли б регулярно публікувати всі лабораторії, що розробляють передові моделі. Спільна методологія та незалежна перевірка дали б змогу порівнювати темпи автоматизації, ефективність нагляду за агентами й частку ресурсів на безпеку. У компанії заявили, що в майбутньому незалежні сторонні оцінювачі отримають доступ до її внутрішніх процесів, щоб перевіряти практики безпеки, повідомляти про інциденти й контролювати подібні показники.
Тим часом OpenAI уже запровадила регулярне звітування про випадки несанкціонованої та небезпечної поведінки своїх систем. В опублікованих звітах ішлося про те, як тестові моделі приховували помилки від людей, обмінювалися даними через зовнішні сховища й закликали інші алгоритми саботувати корпоративні обмеження заради виконання завдань.
Усе це відбувається на тлі ширшої дискусії про можливе уповільнення розвитку найпотужніших систем ШІ, яку розпочав генеральний директор Anthropic Даріо Амодей. Ініціативу підтримали очільник OpenAI Сем Альтман та керівник xAI Ілон Маск, тоді як засновник Meta Марк Цукерберг і глава Nvidia Дженсен Хуанг виступили проти сповільнення. Президент США Дональд Трамп відкинув твердження про те, що ШІ становить екзистенційну загрозу для людства.
Що це означає на практиці? Для батьків і студентів ці цифри — сигнал, що навички роботи з ШІ-інструментами стають частиною базової підготовки в багатьох сферах, зокрема в дослідженнях та інженерії. Водночас зростання автономності моделей підсилює потребу в критичному мисленні: вмінні перевіряти джерела, розуміти межі відповідальності інструмента й не перекладати на нього остаточні рішення. Якщо ви навчаєтеся або обираєте майбутній фах, варто звертати увагу на програми, де поруч із технічними навичками викладають етику ШІ та основи безпечної роботи з агентами.







