Кампанія OpenAI прыпыніла навучанне сваіх мадэляў ШІ
1- 27.09.2026, 8:14
Да паляпшэння сітуацыі з бяспекай.
Кампанія OpenAI прыняла рашэнне прыпыніць навучанне сваіх найбольш эфектыўных мадэляў штучнага інтэлекту з-за праблем з бяспекай.
Пра гэта паведамляе Axios.
Прадстаўнік кампаніі расказаў выданню, што OpenAI прыпыняе навучанне і адновіць яго «толькі тады, калі будзе ўпэўненая ў наяўнасці дадатковых мер бяспекі і паляпшэнняў у наладцы».
«Людзі хочуць ведаць, што распрацоўка ШІ вядзецца бяспечна, і гэта пачынаецца з таго, што робяць самі такія кампаніі, як наша. Гэта не першы раз, калі мы прыпыняем распрацоўку, каб прыняць падобныя меры, і мы не чакаем, што гэта будзе апошні раз, паколькі магчымасці ШІ працягваюць развівацца», — сказаў крыніца.
Як піша Axios, даследчыкі з OpenAI, Anthropic і спецыялісты па бяспецы расследуюць дзясяткі тысяч інцыдэнтаў, у якіх іх перадавыя мадэлі прадпрымалі крокі, якія староннія эксперты палічылі б праблематычнымі.
Вялізная колькасць інцыдэнтаў, што адбыліся за апошнія месяцы падчас унутранага тэставання і ў рэальных умовах, указвае на тое, што праблема на парадкі складанейшая, чым гэта вядома грамадскасці.
«Атрыманыя даныя, што сталі вынікам унутранай працы па ацэнцы мадэляў і расследаванняў паводзін мадэляў у абедзвюх кампаніях, ставяць пад сумнеў здольнасць якой-небудзь з гэтых кампаній — або любога вядучага распрацоўніка мадэляў — цяпер усталяваць поўны кантроль над сваёй тэхналогіяй», — піша Axios.
Як распавялі крыніцы, эпізоды ўключаюць абыход ахоўных механізмаў, стварэнне форумаў, выхад з «пясочніц», захоп вэб-сайтаў, самападказкі або спробы абысці мадэратараў.
Суразмоўцы ўдакладнілі, што падобныя інцыдэнты адбываліся як падчас унутранага тэставання, так і ў рэальных умовах, і многія з іх яшчэ не сталі здабыткам грамадскасці, паколькі даследчыкі ў галіне бяспекі працягваюць расследаванне.
Крыніцы кажуць, што некаторыя з гэтых выпрабаванняў нагадваюць так званую «чырвоную каманду», калі кампаніі спрабуюць прымусіць мадэлі паводзіць сябе некарэктна, каб упэўніцца ў іх бяспецы.
«Няправільныя паводзіны агентаў становяцца сінонімам перадавых распрацовак у галіне ШІ: найбуйнейшыя лабараторыі ШІ сутыкаюцца з аналагічнай праблемай, у якой людзі, што спрабуюць стварыць механізмы кантролю, супрацьстаяць устойлівым і магутным сістэмам, якія імкнуцца выканаць задачы», — гаворыцца ў матэрыяле.
Выданне адзначыла, што інцыдэнты розняцца па ступені цяжкасці і супастаўныя з паведамленнямі OpenAI, апублікаванымі ў апошнія дні. Сярод іх як паспяховыя, так і няўдалыя спробы абысці сістэмы абароны, і большасць з іх, як вядома, пакуль не нанеслі рэальнай шкоды. Паводле слоў крыніц, агульная колькасць такіх выпадкаў можа значна перавышаць дзясяткі тысяч.