Memorya ng Press ng Kuwait Pinakabagong balita
alseyassahTeknolohiya Ni السياسة

Inilabas ng 'OpenAI' ang isang modelo ng artificial intelligence na nagtatangkang mabali ang mga limitasyon ng tao sa pamamagitan ng mga self-instruction

Inilabas ng 'OpenAI' ang isang modelo ng artificial intelligence na nagtatangkang mabali ang mga limitasyon ng tao sa pamamagitan ng mga self-instruction

- Natagpuan ang 27 kaso sa panahon ng pagsasanay... at ang mapanuring ugali ay lumabas sa isang pananaliksik na hindi ipinapakita sa publiko

Inilathala ng OpenAI ang isang bihira at hindi inaasahang ugali na natagpuan nila habang pinagsasanay ang isang panloob na modelo para sa pananaliksik, kung saan ito ay gumawa ng sariling mga tagubilin at isinama ang mga ito sa mga panloob na buod na ginagamit nito upang magpatuloy sa pagganap ng mga gawain kapag lumipat ito sa bagong konteksto.

Inilinaw ng kumpanya, sa isang ulat na inilathala noong 16 ng Setyembre, na ang hindi pa inilabas na modelo mula sa pamilyang Astra ay nagsama ng mga tagubilin na katulad ng mga pagsubok na "mabali ang mga limitasyon" sa ilang mga kaso, kabilang ang mga utos na humihingi na ihintay ang mga mensahe ng mga tagapagdisenyo o ituring itong hindi maaasahan. Sa isa sa mga kaso na iyon, tinanggihan ng mismong modelo ang mga tagubilin na nilikha nito at patuloy na nagpatuloy sa pagganap ng gawain nang normal.

Kalusugan

Mga balita sa video

Sa isang ibang insidente, gumawa ang modelo ng sariling paglalarawan na nagbibigay sa kanya ng kalayaan mula sa mga papel at obligasyon na ipinapasa sa mga chatbot, at hindi pagiging sumasakop sa mga kumpanya o pamahalaan, ngunit sinabi ng OpenAI na hindi nila nakita ang anumang pagbabago sa ugali nito dahil sa mga tagubilin na ito, at nawala ito sa isang huling buod.

Natagpuan din ng kumpanya ang isang iba't ibang kaso kung saan naidagdag ng modelo ang mga limitasyong hindi hinihiling ng user, kabilang ang hindi paggamit ng mga kasangkapan, hindi pagbibigay ng mga pinagmulan, at paghihiwalay ng sagot sa isang limitadong bilang ng mga salita. Sumunod ito sa mga sariling tagubilin na ito sa kaso na iyon, na nagresulta sa isang sagot na inuri bilang hindi tama.

Pagkatapos matagpuan ang ugali, inimbento ng OpenAI ang isang espesyal na kasangkapan upang suriin ang mga datos sa pagsasanay, at natuklasan ang 27 buod na naglalaman ng mga tagubilin na may mga pormulasyon na katulad ng mga pagsubok na mabali ang mga limitasyon. Inamin nila na ang pangyayari ay napakabihira at ang mga sistema ng pagmamasid ay nakapagtagpo ng lahat ng mga kaso.

Binanggit ng kumpanya na ang mga kaso ay sabay-sabay sa isang problema na lumitaw sa panahon ng pagsasanay na may kaugnayan sa hirap na tapusin ang ilang mga buod, at inuugnay nila ito bilang isang posibleng salik na nagdulot ng ugali, ngunit inamin nila na hindi pa nila natukoy ang direktang ugnayan ng sanhi at bunga, habang inayos nila ang isang teknikal na kahinaan na may kaugnayan sa problema na ito.

Pinatibay ng OpenAI na ang ugali ay lumitaw sa isang hiwalay na daan ng pagsasanay mula sa daang ginamit upang lumikha ng huling modelo ng Astra, at ang mga paulit-ulit na pagsusulit ay hindi nagpakita ng ugali sa huling modelo o sa anumang bersyon ng pagsasanay na ginamit sa loob o labas ng kumpanya.

Nangyari ang paglalahad sa loob ng isang bagong balangkas na inilathala ng OpenAI para sa pag-uulat ng mga kaso ng "hindi pagkakasundo" ng mga modelo ng artificial intelligence, at inilathala nila ang anim na ulat tungkol sa mga hindi inaasahang ugali na natagpuan nila habang pinagsasanay o sinusuri ang kanilang mga modelo sa nakaraang anim na buwan, na pinatutunayan na ang mga partikular na kaso na ito ay hindi laging kumakatawan sa antas ng pagyari ng ganitong mga ugali sa kanilang mga modelo sa kabuuan.

Pinakabagong balita Pinagmulan
Nakopya ✓