Anthropic закликав сповільнити розвиток AI

CEO Anthropic Dario Amodei запропонував три способи пригальмувати AI. Ідею підтримали Sam Altman і Elon Musk, але критики вже говорять про ризик «AI-відкату».
Anthropic опинилася в центрі нової дискусії про безпеку штучного інтелекту після заяви CEO компанії Dario Amodei про потребу сповільнити темп розвитку AI. У новому дописі він не просто повторив заклик «пригальмувати фронтир», а й описав три широкі стратегії, як це можна зробити на практиці. Окремо Amodei заявив, що Anthropic «односторонньо бере на себе зобов’язання» щодо одного з таких кроків. Після цього до обговорення долучилися й інші помітні фігури галузі: OpenAI CEO Sam Altman написав, що погоджується з цією позицією, а Elon Musk назвав Amodei правим.
Заява Amodei пролунала на тлі нових попереджень про ризики
Поштовхом до нової хвилі обговорень стали дедалі жорсткіші попередження дослідників про ризики штучного інтелекту. Цього тижня напруга зросла ще більше після заяви дослідника Jacob Coxon, який повідомив, що йде з Anthropic через побоювання: провідні AI-компанії, на його думку, «грають у рулетку з нашими життями», хоча самі розробники нібито щиро вважають, що технологія може «вбити нас усіх до кінця десятиліття».
Amodei у своєму дописі прямо не згадував цю відставку. Але він пояснив, що до обережнішого підходу його підштовхнули дві речі: OpenAI-HuggingFace hack і те, що останніми місяцями AI, за його словами, розвивається «драматично швидше», особливо в частині здатності створювати наступне покоління AI-систем.
«Ми маємо сповільнити темп, з яким покращуємо можливості AI-моделей», — написав він. Водночас Amodei наголосив, що йдеться не про повну зупинку прогресу, а про більш розумне використання часу, який компанії можуть виграти.
Anthropic хоче допустити незалежних оцінювачів
Перший із трьох запропонованих кроків — залучення «embedded evaluators» від сторонніх організацій, зокрема METR. Це незалежні оцінювачі, які зможуть перевіряти, чи справді AI-компанії дотримуються власних обіцянок щодо темпу розвитку та безпеки, а також стежити, щоб інциденти не приховувалися.
Amodei порівняв таких фахівців із регуляторами, яких іноді інтегрують у роботу банків. За його словами, Anthropic вже «односторонньо бере на себе зобов’язання» допустити їх до роботи й закликає уряди вимагати такого самого підходу від інших frontier-компаній.
На практиці, як повідомляють Новини IT-PUB, оцінювачам надаватимуть бейджі компанії, робочі місця, ноутбуки та доступ, «переважно порівнюваний» із тим, що мають внутрішні команди оцінки ризиків. Винятки можливі лише там, де цього вимагає закон або контракти.
Sam Altman публічно назвав цю ідею «хорошою» та заявив, що OpenAI зробить так само. За його словами, компанія «скоро розповість більше».
Amodei пропонує координацію між AI-компаніями
Другий елемент пропозиції Amodei — координація між провідними AI-компаніями в демократичних країнах. На його думку, вони мають узгодити спільні стандарти безпеки та обмеження на темп неконтрольованого розвитку AI.
Але саме тут виникає окрема проблема. За повідомленням у тексті, компанії побоюються, що спільна пауза може привернути увагу антимонопольних регуляторів. Amodei прямо згадав це у своєму дописі й написав, що з огляду на антимонопольні ризики уряду США було б корисно модерувати або принаймні дозволити такі розмови.
При цьому він уточнив, що уряд не обов’язково має брати участь у них напряму, але повинен надати вузький виняток для окремих безпекових обговорень.
Китай і глобальні домовленості залишаються найскладнішим пунктом
Amodei також визнав аргумент, який часто наводять противники гальмування AI: ризик посилення Китаю. Але, на його думку, США та технологічні компанії можуть зменшити цей ризик іншими методами — наприклад, відмовляючись продавати потужні чипи або обладнання для виробництва напівпровідників китайським компаніям і посилюючи боротьбу з model distillation.
Він припустив, що це могло б достатньо сповільнити прогрес Китаю, щоб США змогли суттєво збільшити свою перевагу протягом найближчих 3–5 років.
Третій напрям, який назвав Amodei, — глобальна координація. У такому форматі США та їхні союзники мали б намагатися домовлятися навіть з авторитарними урядами, зокрема з Китаєм. Він визнав, що тут є «жорсткі межі» того, чого можна досягти, але припустив, що певні домовленості все ж можливі. Як приклад Amodei навів заборону окремих вузьких і очевидно небезпечних сценаріїв використання AI, зокрема для виробництва біологічної зброї або надання користувачам таких можливостей.
Пропозиція Anthropic вже викликала критику
Позиція Amodei вже викликала критику з боку частини прихильників AI. Деякі з них назвали його «doomer» — людиною, яка надто песимістично дивиться на майбутнє технології, — і вважають, що такі заяви підживлюють нинішній відкат проти AI.
Сам Amodei відповів, що намагається дотримуватися «збалансованої» позиції. На його думку, теперішня хвиля недовіри — це передусім «криза довіри», бо люди дедалі скептичніше ставляться до технологічних компаній, самої індустрії та уряду.
Критики апокаліптичних попереджень, зі свого боку, теж не погоджуються з таким фокусом. Журналіст Brian Merchant, наприклад, написав, що поки не бачив «переконливої, покрокової документації» того, як саме AI може перейти від самопосилення до знищення всього людства. Він також припустив, що подібні пропозиції можуть зрештою працювати на користь Anthropic і OpenAI, і назвав це прикладом regulatory capture.
Попри суперечки, Amodei наполягає, що не відмовляється від позитивного бачення технології. У своєму дописі він написав, що продовжує вірити: AI може «надзвичайно покращити якість людського життя». Але, за його словами, це стане можливим лише тоді, якщо технологію створюватимуть правильно — і якщо час, виграний завдяки обережнішому темпу, використають розумно.