Новий рубіж безпеки штучного інтелекту: міжлабораторне тестування для об'єднання індустрії
- Ilya Sutskever з OpenAI виступає за міжлабораторне тестування для посилення безпеки штучного інтелекту на тлі стрімкого технологічного прогресу та ризиків для всієї галузі. - Пілотний браузерний проєкт Claude від Anthropic підкреслює проблеми безпеки, зокрема атаки через інʼєкцію підказок, що призводить до впровадження посилених стратегій помʼякшення ризиків. - Дослідження показує низький рівень дотримання добровільних зобовʼязань щодо безпеки з боку основних компаній у сфері штучного інтелекту, включаючи Apple, що ставить під сумнів ефективність саморегулювання. - Ініціатива AI Safety від Cloud Security Alliance пропонує фреймворки та RiskRub.
Співзасновник OpenAI та член ради директорів Ілля Суцкевер закликав до впровадження міжлабораторного тестування як критично важливого заходу для забезпечення безпеки систем штучного інтелекту (AI). Його заява пролунала на тлі зростаючого занепокоєння щодо ризиків, пов’язаних із розвитком AI, коли лідери галузі наголошують на необхідності спільних, стандартизованих протоколів безпеки. Заклик Суцкевера до міжлабораторного тестування узгоджується з ширшими зусиллями щодо посилення безпеки AI та зменшення потенційної шкоди у міру стрімкого розвитку цієї технології [1].
Необхідність таких спільних підходів підкреслюється останніми подіями у впровадженні та регулюванні AI. Наприклад, Anthropic, один із ключових гравців у сфері AI, запустив пілотну програму для свого AI-асистента Claude, розробленого для роботи безпосередньо у браузерах користувачів. Ця ініціатива, яка має на меті підвищити корисність AI шляхом інтеграції у основні цифрові робочі процеси, також висвітлила значні виклики безпеки, пов’язані з браузерними AI-агентами. Атаки шляхом ін’єкції підказок—коли зловмисники маніпулюють поведінкою AI, вбудовуючи приховані інструкції—стали ключовим ризиком, що спонукало Anthropic впровадити надійні стратегії пом’якшення, такі як дозволи на рівні сайтів, підтвердження дій та вдосконалені класифікатори для виявлення підозрілих шаблонів [2].
Такі ризики не обмежуються окремими компаніями. Недавнє дослідження вчених з Brown, Harvard та Stanford показало, що багато AI-компаній не повністю дотримуються своїх добровільних зобов’язань щодо безпеки, особливо після обіцянок адміністрації Байдена щодо безпеки AI у 2023 році. Наприклад, Apple показала низькі результати в оцінці, з доказами виконання лише одного з восьми зобов’язань. Дослідження підкреслює обмеження саморегулювання у стрімко мінливій галузі та ставить під сумнів ефективність добровільних заходів для забезпечення відповідальності та безпеки [5].
У відповідь на ці виклики Cloud Security Alliance (CSA) наприкінці 2023 року запустив ініціативу AI Safety Initiative, об’єднавши лідерів галузі, державні агентства та академічні установи для розробки практичних інструментів і рамок управління ризиками AI. Ініціатива надає організаціям чек-листи готовності до AI, рамки управління та рекомендації з безпеки з метою узгодження технологічного прогресу з регуляторними очікуваннями. Зокрема, CSA також представила RiskRubric.ai—систему оцінювання, яка аналізує безпеку, прозорість і надійність великих мовних моделей (LLMs), пропонуючи підприємствам підхід до впровадження AI, заснований на даних [4].
Спільні зусилля щодо підвищення безпеки AI також підтримуються зростаючою екосистемою фондів та грантових програм. Організації, такі як Long-Term Future Fund, Survival and Flourishing Fund та AI Safety Fund, надають фінансову підтримку дослідникам, підприємцям і установам, які працюють над зменшенням ризиків AI. Ці ініціативи спрямовані на вирішення довгострокових екзистенційних ризиків, а також на сприяння відповідальним інноваціям. Крім того, венчурні фонди, такі як Juniper Ventures та Mythos Ventures, інвестують у стартапи, що розробляють інструменти для підвищення безпеки, відповідності та управління AI [6].
Заклик до міжлабораторного тестування, якого дотримується Суцкевер, є ключовим кроком до вирішення цих системних викликів. Завдяки впровадженню спільних стандартів і прозорої оцінки між лабораторіями розробки AI галузь може сприяти більшій довірі та відповідальності. Такий підхід особливо важливий у міру ускладнення та зростання можливостей AI-систем, що вимагає єдиного фронту для оцінки потенційних ризиків до впровадження. OpenAI, Anthropic та інші ключові учасники мають можливість—і відповідальність—очолити цей перехід, впроваджуючи спільні протоколи безпеки та встановлюючи прецедент для відповідальних інновацій у сфері AI [1].
Відмова від відповідальності: зміст цієї статті відображає виключно думку автора і не представляє платформу в будь-якій якості. Ця стаття не повинна бути орієнтиром під час прийняття інвестиційних рішень.
Вас також може зацікавити
Уся увага прикута до Волша: чи принесе наступний тиждень “супертиждень центральних банків” хвилю підвищення ставок серед країн G7?
На тлі зростання інфляції, геополітичної напруженості та подолання нафтовими цінами позначки у 100 доларів, центральні ба нки G7 виходять на ключовий тиждень рішень щодо ставок. Під впливом більш високої, ніж очікувалося, базової інфляції, Федеральна резервна система США, ймовірно, здійснить перше підвищення ставки за три роки; Банк Японії, ймовірно, підвищить ставку до 1,25%, що стане найвищим рівнем за останні 30 років; водночас Банки Англії, Європи та Канади також активізують свій яструбиний підхід. Світова грошово-кредитна політика переживає важливий етап колективного посилення.
Чи буде Федеральна резервна система "безперервно підвищувати ставки"? Чи повториться "цикл жорсткої монетарної політики" кінця 1980-х років?
Звіт Citigroup зазначає, що поточна макроекономічна ситуація дуже схожа на період циклу жорсткої монетарної політики 1988-1989 років, коли економіка залишалася стійкою, інфляційний тиск поступово зростав, а потім економічна активність уповільнювалася і політика переходила до пом’якшення. Під час того циклу Federal Reserve підвищила процентні ставки 16 разів поспіль.
Рідкісний союз ворогів! Маск, Aaltman підтримують заклик Dario Amodei “глобально сповільнити AI”
Антропік Амодей виступив із закликом до «глобального уповільнення AI», при цьому суперники Маск і Альтман навіть обидва публічно підтримали цю ініціативу. Три великі гіганти одностайно погодилися надати стороннім особам доступ до «співробітницьких» оцінок і впровадити скоординоване уповільнення; Альтман ще й напряму заявив, що OpenAI цього року не буде проводити IPO. Різке звільнення одного дослідника і масова « втеча» неконтрольованих AI розпалила довго накопичений страх у індустрії.
Остання оцінка Goldman Sachs: зростання ставок ≠ падіння американських акцій, зростання прибутку є ключем до бичачого ринку
Goldman Sachs вважає, що високі процентні ставки є зустрічним вітром для фондового ринку, але не силою, яка завершить бичачий ринок. Доходність 30-річних облігацій США підскочила до 5,3%, але історичні дані показують, що середня прибутковість акцій за 12 місяців після підвищення ставок становить +9%. Баланси компаній перебувають на найвищому рівні за останні 20 років, а інвестиції в AI та хвиля злиттів і поглинань продовжують підтримувати очікування прибутків. Очікується, що прибуток на акцію S&P 500 у 2026 році складе 340 доларів, що на 24% більше порівняно з попереднім роком.