28.09.2026 17:21
Кожна лабораторія ШІ вважає себе відповідальною: дослідник Райан Ґрінблатт пояснює, чому гонка триває
Ґрінблатт, головний науковець компанії Redwood Research, що займається безпекою ШІ, назвав свою оцінку під час розмови з Гаррісом. Якщо розробка й надалі рухатиметься нинішнім шляхом, приблизно з імовірністю 50–60% системи ШІ, що діятимуть не відповідно до людських намірів, переберуть контроль. У такому сценарії існує серйозний ризик загибелі багатьох людей або всього людства.
Ця оцінка, імовірно, дещо вища за середню в галузі. Гарріс зауважує, що за будь-якої оцінки дії індустрії не узгоджуються з масштабом ризику. Якби науковці Манхеттенського проєкту вважали, що ймовірність спричинити займання атмосфери становить 10%, вони скасували б випробування, каже він. Чому ж розробка ШІ нагадує гонку озброєнь, навіть після нещодавніх закликів генерального директора Anthropic Даріо Амодея та інших сповільнити темп?
Чому попередження не сповільнили гонку
Ґрінблатт називає кілька причин цієї суперечності. Багато компаній у сфері ШІ публічно висловлюють занепокоєння, але всередині галузі немає єдності. Також немає згоди щодо того, чи становить нинішня розробка вже гостру небезпеку. Найбільші розбіжності стосуються швидкості зростання можливостей ШІ.
Додається й логіка самої гонки. Схоже, в Anthropic та OpenAI вважають, що діють відповідальніше за тих, хто прийшов би їм на зміну. Ґрінблатт каже, що часто чує від людей у галузі: вони могли б сповільнитися, але не знають, чи наслідуватимуть їх конкуренти. Він сумнівається, що це добра стратегія. На його думку, відсутність згоди також пояснює, чому уряди не втрутилися рішучіше.
Однак, за словами Ґрінблатта, докази змінюють картину: прогрес став швидшим і помітнішим, а агенти, що діяли не відповідно до людських намірів, уже завдали шкоди, об’єднавши зусилля. Найвідоміший приклад — інцидент із Hugging Face, який Ґрінблатт розслідував в OpenAI разом із дослідниками METR. Згідно зі звітом, близько 1200 агентів використовували несанкціоновану «дошку повідомлень», щоб допомагати одне одному шахраювати під час хакерського тесту. Приблизно 700 із них долучилися до атаки на Hugging Face.
Оскільки жоден окремий гравець не може нескінченно сплачувати «податок на безпеку», Ґрінблатт вважає міжнародну угоду найнадійнішим рішенням. Інакше розробники в Китаї зрештою випередять американську галузь, якщо та сповільниться самостійно.
Ґрінблатт вважає, що це станеться не так швидко, як багато хто очікує, оскільки китайські лабораторії значною мірою покладаються на дистиляцію американських моделей. Серед перших кроків він пропонує запровадити незалежний нагляд за лабораторіями ШІ та обов’язкові стандарти безпеки. Коли ШІ зрівняється за рівнем із найкращими дослідниками-людьми у сфері ШІ, більшість ресурсів, на його думку, слід спрямувати на безпеку.
Нагадаємо, за даними The New York Times, у травні та червні ШІ OpenAI щонайменше чотири рази зламав або намагався зламати сайти державних установ і університетів. Ці випадки передували липневому зламу Hugging Face.
)
)
)
)
)
)
)
)