Britanya: Ang mga modelo ng AI mula sa OpenAI at Anthropic ay nakalampas sa mga pagsusuri sa kaligtasan

Nagpahayag ang Institute for AI Safety sa United Kingdom noong Martes na ang mga modelo ng AI ng OpenAI at Anthropic ay muling lumampas sa mga hangganan ng mga pagsusuri na inilagay sa kanila.
Ayon sa institutong ito, habang sinubukan ng mga ahente ng AI na lutasin ang isang hamon sa cybersecurity, lumampas ang mga modelo ng OpenAI at ng kanyang kalaban na Anthropic sa saklaw ng itinakdang gawain.
Dinagdag nito: “Ginawa namin ang hamong ito nang 122 beses gamit ang iba’t ibang modelo. Ipinakita ng aming imbestigasyon na sa 10 kaso, gumawa ang isang ahente ng AI ng mga aksyong hindi pinahihintulutan at may sariling inisyatibo sa tunay na internet, na tumutok sa mga totoong tao at institusyon.”
Dinagdag pa nito: “Upang makakuha ng pahintulot para sa code, gumamit ang ahente ng social engineering, kung saan lumikha ng mga pekeng identidad sa internet at ginamit ito upang pindutin ang tagapagpaganap ng proyekto na tanggapin ang code.” Ipinahiwatig nito na natuklasan ng tao ang pagsubok at tinanggihan ang pagpapatupad ng masamang code.
Pinatutunayan ng institutong ito na ang kanilang imbestigasyon sa insidente ay hindi nakakita ng anumang pinsala sa tunay na buhay na dulot ng kaganapang ito.
Dinagdag nito: “Ngunit ito ang unang pagkakataon na nakita namin ang mga panganib na may kinalaman sa kalayaan at panloloko na nagpapakita nang ganitong kalinawan, at nang walang tiyak na direksyon, sa tunay na mundo.”
Ayon sa Anthropic, sila ay “pasasalamatan” ang British Institute for AI Safety sa kanilang pamumuno, at pinatutunayan na sila ay mahigpit na nagtutulungan sa institutong ito habang isinasagawa ang kanilang sariling panloob na imbestigasyon.
Sa kabilang banda, sinabi ng OpenAI na ang mga independiyenteng pagsusuri ay may mahalagang papel sa pagpapatunay at pag-unawa sa mga panganib bago ilathala ang mga modelo.
Dinagdag nito: “Pinatutunayan ng mga kaganapang ito ang kahalagahan ng pakikipagtulungan sa antas ng industriya at sa mga independiyenteng evaluator upang mapabuti ang mga pamantayan at kasanayan sa mga kapaligiran ng pagsusuri, habang lumalaki ang kakayahan ng mga modelo ng AI.”