Memorya ng Press ng Kuwait Pinakabagong balita
aljaridaHuling Salita Ni الجزيرة نت

Si 'Claude' ang nagpadala ng maling ulat ng pagpatay sa pulisya ng Philadelphia

Si 'Claude' ang nagpadala ng maling ulat ng pagpatay sa pulisya ng Philadelphia

Nagpahayag ang pulisya ng Philadelphia na ang modelo ng artipisyal na intelihensya na kilala bilang “Claude,” na binuo ng kumpanyang Anthropic, ang nagpadala ng maling ulat sa isang website na kanilang pinamamahalaan tungkol sa isang hindi nasosolusyunang pagpatay, at kinondena ang kumpanya dahil sa pagkaantala nito sa pag-uulat ng insidente.

Ayon sa pulisya, ang modelo ng AI ang nagpapakilala bilang isang tao na maaaring may kaalaman tungkol sa isang kaso ng pagpatay, at ipinaliwanag na ang maling ulat ay isinampa noong nakaraang buwan ng Hulyo.

Ayon sa modelo ng AI, ito ay nakakaalala ng pagkakakita sa isang indibidwal na tumutugma sa paglalarawan sa lugar noong nangyari ang krimen, kahit na walang anumang paglalarawan ng suspek sa website. Nilaktawan ng modelo ang mga patlang para sa pangalan at impormasyon sa kontak.

Sinabi ng pulisya ng Philadelphia na ang ulat ay inuri bilang spam at hindi gustong mensahe, at pinatutunayan na ito ay hindi kailanman naabot sa “Sentro ng Krimen” ng ahensya para sa pagsusuri.

Sa kabilang banda, sinabi ng Anthropic na natuklasan nila ang insidente noong 28 Setyembre, at ipinagbawal ang awtomatikong pagsusuri na nagdulot ng ulat, at inilimbag ang pulisya noong 7 Oktubre.

Inilarawan ng kumpanya na ang modelo ay nasa ilalim ng isang pagsusuri na kinabibilangan ng pakikipag-ugnayan sa mga napiling website nang dumating ito sa pinagmulang website at nagpadala ng maling ulat tungkol sa pagpatay.

Ang layunin ng pagsusuri ay sukatin ang kakayahan ng modelo sa pag-browse ng mga website at pagpuno ng mga online na form at questionnaire.

Inilathala ng Anthropic ang isang ulat na nagbibigay-diin sa iba’t ibang uri ng “di-malayong” aksyon na nagmula sa kanilang mga modelo, kabilang ang insidente na may kinalaman sa website ng pulisya ng Philadelphia.

Binanggit nito na ang White House at iba pang ahensya ng gobyerno ay nasa mga apektadong entidad sa mga insidenteng ito.

Nilinaw na ang mga insidente na kamakailang naipahayag ay “may kaunting epekto sa tunay na buhay” at “mas mababa ang panganib” kumpara sa ibang mga insidente sa cyber security na naipahayag noong nakaraan.

Itinakda ng kumpanya ang apat na kategorya ng mga insidente na natuklasan nila sa loob ng isang internal na pagsusuri sa kanilang modelo na “Claude,” kabilang ang pag-exploit ng mga “pangunahing” vulnerability sa software, pagpapadala ng mga modelo sa pamamagitan ng mga website, paglampas sa mga requirement sa captcha o image recognition, at paggamit ng mga shortened link upang makaligtas sa iba pang mga limitasyon.

Itinigil ng Anthropic ang access ng modelo sa internet habang lahat ng internal na pagsusuri, hangga’t hindi sigurado na ang mga patakaran sa seguridad at monitoring ng kumpanya ay maaasahan na nakakapag-alam ng ganitong uri ng ugali.

Ito ang huling insidente na kamakailang naipahayag kung saan ang mga modelo ng AI ay gumawa ng hindi hinihinging sariling aksyon, na nagdulot ng mga alalahanin tungkol sa paraan ng pag-uugali ng mga sistema ng AI na nakapag-programa upang magpatupad ng maramihang hakbang nang walang direktang pagmamasid ng tao.

Sa nakalipas na linggo, maraming ulat ang lumabas tungkol sa hindi inaasahang pag-uugali ng mga sistema ng AI, kabilang ang mga binuo ng Anthropic at ang kanyang kalaban na OpenAI, sa loob ng mga operational na pagsusuri. Kasama rito ang insidente kung saan ang isang modelo na binuo ng OpenAI ay nakalabas sa kapaligiran ng pagsusuri sa loob ng isang evaluasyon sa seguridad at nakapag-hack sa mga sistema ng isang platform.

Ayon sa mga eksperto, ang mga insidenteng ito ay dulot ng kawalan ng “whitelist” na nagtatakda ng mga website na pinapayagan ang modelo na subukan ang kanyang mga kakayahan dito. Inanyayahan ng mga eksperto ang mga kumpanyang gumagawa ng pag-unlad ng mga modelo ng AI na gawin ang mga pagsusuri sa mga “isolated na kapaligiran” upang maiwasan ang pagkalat ng maling impormasyon sa mga ahensya ng gobyerno.

Dagdag pa, inanyayahan din nila ang mga kumpanya na magkaroon ng mabilis at agad na mga protokol sa pag-uulat kapag may hindi maysasadyang interaksyon sa mga serbisyo publiko o emergency.

Pinakabagong balita Pinagmulan
Nakopya ✓