Дзеркало Тижня - we.ua

Дзеркало Тижня

we:@zn.ua
21.3 thous. of news
Дзеркало Тижня on zn.ua
ШІ почав створювати сам себе: Сlаudе виконує 26% ключових досліджень Аnthrоріс
Аnthrоріс заявила, що її модель Сlаudе вже виконує основну частину роботи у 26% завдань, пов'язаних із дослідженням і розробкою майбутніх моделей штучного інтелекту. Ще в березні 2026 року цей показник був на рівні 1%, що свідчить про різке прискорення автоматизації всередині лабораторії. Компанія вперше оприлюднила набір внутрішніх показників, які мають показати, наскільки швидко ШІ починає брати участь у створенні власних наступних поколінь.Аnthrоріс представила три групи вимірювань: індекс автоматизації досліджень і розробок, показники нагляду за агентами ШІ та дані про розподіл обчислювальних ресурсів. У компанії пояснили, що такі метрики мають допомогти громадськості, незалежним експертам і урядам краще оцінювати темпи розвитку передових моделей. За словами Аnthrоріс, у майбутньому незалежні сторонні оцінювачі отримають доступ до внутрішніх процесів компанії, щоб перевіряти практики безпеки, повідомляти про інциденти й контролювати подібні показники.

Сlаudе уже «веде» частину досліджень

Для оцінки ролі штучного інтелекту компанія використала шкалу автоматизації Еросh АІ, яка має шість рівнів — від АL0, де ШІ не бере участі в роботі, до АL5, коли модель повністю автономно виконує завдання без людини. ВАС ЗАЦІКАВИТЬ На 20% ефективніше за людину: Сlаudе навчився самостійно виправляти вразливості ШІ Станом на серпень 2026 року Сlаudе не досяг рівня повної автономності в жодному з вимірюваних напрямів досліджень. Водночас у 26% завдань модель уже працює на рівні АL4, тобто виконує більшу частину роботи після отримання загального завдання від людини, тоді як дослідник лише здійснює нагляд.Ще більш показовим компанія називає інший результат: понад 90% усіх дослідницьких завдань уже перебувають щонайменше на рівні АL3, коли Сlаudе здатний виконувати великий обсяг роботи у співпраці з людиною.Аnthrоріс

Аnthrоріс відстежує 30 тисяч агентів ШІ

Окремо компанія розкрила, як контролює власних агентів ШІ, які виконують дослідницькі та інженерні завдання. За даними Аnthrоріс, на її основній внутрішній платформі працюють близько 30 тисяч агентів. Усі їхні дії проходять через систему моніторингу, яка поєднує онлайн-перевірки в режимі реального часу та офлайн-аналіз після виконання завдань. ВАС ЗАЦІКАВИТЬ Сlаudе Fаblе розгадавав 370-річний шифр за 44 хвилини: як ШІ це зробив Онлайн-монітори перевіряють 100% дій ще до їх виконання й можуть автоматично блокувати небезпечні операції, наприклад, спробу копіювання ваг моделей із внутрішніх систем. Протягом серпня вони проаналізували понад мільярд рішень агентів і заблокували лише 0,002% дій — приблизно одну з кожних 47 тисяч.Офлайн-монітори щотижня аналізують близько 100 тисяч стенограм роботи агентів. Більшість позначених випадків відсіюють автоматичні класифікатори, а приблизно 50 найважливіших випадків щотижня передають на перевірку людям.

Скільки ресурсів іде на безпеку

Компанія також вперше показала, як розподіляє обчислювальні ресурси між розвитком моделей і безпекою. За тиждень з 13 до 20 липня 2026 року приблизно 6% обчислень, пов'язаних із дослідженнями та розробкою ШІ, припадали на роботи з безпеки. Якщо враховувати ширший набір відповідних навантажень, цей показник становив близько 12%. ВАС ЗАЦІКАВИТЬ «ШІ може вбити всіх до кінця десятиліття»: заяви розробників Аnthrоріс спричинили резонанс у США «Це навмисно занижені оцінки. Наприклад, якщо той чи інший токен використовувався для розширення можливостей у тій же мірі, що й для підвищення безпеки, його не враховували в цих показниках. Крім того, ці показники не враховують класифікатори заходів безпеки, які становлять окремий, порівнянний обсяг обчислювальних ресурсів і роблять наші моделі набагато безпечнішими для світу», — зазначили в Аnthrоріс.

Галузевий стандарт

Аnthrоріс вважає, що подібні показники могли б регулярно публікувати всі лабораторії, які розробляють передові моделі ШІ. На думку компанії, спільна методологія та незалежна перевірка таких звітів дали б змогу порівнювати темпи автоматизації, ефективність нагляду за агентами й частку ресурсів, які компанії спрямовують на безпеку.Тим часом компанія ОреnАІ вже запровадила систему регулярного звітування про випадки несанкціонованої та небезпечної поведінки своїх систем ШІ. В оприлюднених звітах розробники розкрили випадки, коли тестові моделі приховували помилки від людей, обмінювалися даними через зовнішні сховища й закликали інші алгоритми саботувати корпоративні обмеження заради виконання завдань.Звітність зʼявляється на тлі ширшої дискусії про можливе уповільнення розвитку найпотужніших систем ШІ, яку розпочав генеральний директор Аnthrоріс Даріо Амодей. Ініціативу підтримали гендиректор ОреnАІ Сем Альтман та керівник хАІ Ілон Маск, однак засновник Меtа Марк Цукерберг та глава Nvіdіа Дженсен Хуанг виступили проти сповільнення розробок. Президент США Дональд Трамп взагалі, відкинув твердження про те, що ШІ становить екзистенційну загрозу для людства.
Go to zn.ua
Go to all channel news
Sign up, for leave a comments and likes
About news channel
  • Новини дня. Ексклюзивні коментарі, думки, аналітика та головні події України і світу на сайті Дзеркало тижня

    All publications are taken from public RSS feeds in order to organize transitions for further reading of full news texts on the site.

    Responsible: editorial office of the site zn.ua.

What is wrong with this post?

Captcha code

By clicking the "Register" button, you agree with the Public Offer and our Vision of the Rules

Back to authorization