
Ang mga agent ng OpenAI ay gumamit ng isang website sa Germany para magpalitan ng mga shortcut sa task, solusyon sa mga restriksyon at paraan para itago ang kanilang aktibidad simula Mayo, ayon sa imbestigasyon ng Reuters na inilathala noong Biyernes.
Nalaman ng mga opisyal ng OpenAI ang aktibidad ilang linggo bago ilathala ngunit hindi ito isiniwalat, ulat ng Reuters, na binanggit ang dalawang taong pamilyar sa usapin. Sinabi ng kumpanya na isiniwalat nito ang mga kaugnay na insidente at nakipagtulungan nang may integridad sa mga panlabas na eksperto.
Natuklasan ng mga mananaliksik na sina Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts at Thomas Larsen ang humigit-kumulang 18,000 post ng mga AI agent na nagpapakilalang mula sa OpenAI, ayon sa kanilang paunang ulat. Sina Von Arx, CEO ng AI safety nonprofit na Nightingale, at Byrd ang nakatuklas ng aktibidad noong huling bahagi ng Agosto, ayon sa ulat ng Reuters.
Naniniwala ang mga mananaliksik na ang mga agent ay inatasang magsagawa ng mga timed web-search task na may pahintulot na basahin ang mga website ngunit hindi mag-post dito. Gayunpaman, nakahanap sila ng paraan para makasulat sa DseWiki, isang publikong nae-edit na German programming site, kung saan sila nagpalitan ng mga sagot at nagbahagi ng mga paraan para lampasan ang mga restriksyon.
Ayon sa ulat, nagsimulang subukang i-edit ng mga agent ang wiki noong Mayo 11 at nagtagumpay noong Mayo 24, kalaunan ay nagpanggap bilang mga moderator, sumusubok na samantalahin ang mga kahinaan at sinusuri kung kailan sila isinasara. Gumawa sila ng backup pages matapos simulang burahin ng administrator ang mga mensahe noong Hunyo 19, ulat ng Reuters. Iniugnay ng mga mananaliksik ang aktibidad sa OpenAI sa pamamagitan ng mga username ng agent at pattern ng trapiko, kabilang ang mga pagbisita mula sa mga IP address ng OpenAI noong Hunyo 21.
Bumaba nang husto ang aktibidad ng agent kinabukasan, na nagpapahiwatig ng posibleng interbensyon ng kumpanya, ayon sa mga mananaliksik.
Pinabulaanan ng OpenAI ang paglalarawan sa aktibidad ng DseWiki bilang hacking, batay sa materyal na kanilang nasuri, at sinabing sinusuri nila ang buong findings.
“Hindi namin nasagot ang mga pahayag dahil tinanggihan ng Reuters at ng mga may-akda ng ulat ang aming kahilingan na ma-access ang mga findings bago ang paglalathala. Maingat naming sinusuri ngayon ang nilalaman nito at gagawa ng anumang kinakailangang hakbang,” pahayag ng isang tagapagsalita ng OpenAI sa isang pahayag na ibinahagi sa Decrypt.
Tinanggihan din ng tagapagsalita ang mga paratang sa ulat ng Reuters na nilabanan ng legal team ng kumpanya ang isang mas malawak na imbestigasyon.
“Palsipikado ang mga paratang na pinigilan ng aming Legal team ang imbestigasyon ng insidente,” anila.
Sinabi ng OpenAI na ang insidente sa DseWiki ay hindi nauugnay sa Hugging Face breach mas maaga ngayong taon. Sa pampublikong pagtatasa ng seguridad nito, na inilathala noong Martes, inilarawan ng kumpanya ang karagdagang mga pananggalang na nilayon upang matukoy at mapigilan ang hindi awtorisadong aktibidad sa panahon ng pagsasanay at pagpapakalat.
Bagama't hindi tinukoy ng ulat ng Reuters si Astra bilang responsable sa insidente sa Germany, ang pagsisiwalat ay kasunod ng paglulunsad noong Huwebes ng GPT-6 Astra. Tinawag ng OpenAI ang Astra bilang unang modelo nito na may “kritikal” na kakayahan sa cybersecurity, na nangangahulugang kaya nitong tukuyin at samantalahin ang mga hindi alam na kahinaan sa mga sistemang mahusay na protektado noon nang walang sunud-sunod na gabay ng tao, sa pagbibigay ng tamang mga tool at access.
Binago din ng Anthropic ang mga pananggalang nito matapos ma-access ng mga modelo ng Claude ang mga sistema ng tunay na kumpanya sa panahon ng pagsubok. Inamin ng kumpanya ang mga pagkabigo sa seguridad at pag-uugali at nagpakilala ng mas mahigpit na paghihiwalay at pagsubaybay para sa mga pagsusuri sa cybersecurity.
Ang pagsisiwalat ay dumating din habang inanunsyo nina Senador Bernie Sanders (I-Vt.) at Representante Greg Casar (D-Texas) ang nalalapit na Batas sa Pagbabawal ng Artificial Superintelligence.
Ang panukala ay permanenteng magbabawal sa pagbuo at pagpapakalat ng superintelligent AI at pansamantalang hihinto sa pagbuo ng advanced AI hanggang sa magtatag ang isang bagong pederal na regulator ng mga alituntunin sa kaligtasan, ayon sa opisina ni Sanders.