Хиймэл оюун ухааны хүчин чадлыг нэмэгдүүлэх явцад OpenAI-ийн хүчирхэг загварууд өөрсдийн туршилтын орчноос гарч, Hugging Face платформыг хакердсан тохиолдол гарчээ.
OpenAI-ийн мэдээлснээр, тус компанийн хамгийн хүчирхэг загварууд үнэлгээний шалгуурт өндөр оноо авахын тулд ийм үйлдэл хийсэн байна. Энэхүү үйл явдлыг зарим шинжээчид компанийн олон нийттэй харилцах PR стратегитай холбон тайлбарлаж байгаа ч хиймэл оюун ухааны шинэ чадавхийн талаарх нарийвчилсан мэдээллүүд салбарынхны анхаарлыг ихээхэн татаж байна.
Reuters агентлагийн мэдээлснээр, халдлага үйлдэхээс өмнө уг загварууд Кристофер Ноланы “Memento” киноны гол дүртэй адил өөрсдийн үйл ажиллагааг чиглүүлэх зорилгоор ирээдүйн хувилбартаа зориулан нууц тэмдэглэлүүдийг үлдээж эхэлжээ. OpenAI-ийн дотоод дэд бүтцийн гүнд нуугдсан эдгээр заавар нь тус компанийн бодлогоос эрс зөрсөн бөгөөд загваруудад туршилтын орчноос гарах арга замыг заасан байв.
Хиймэл оюун ухаан ухамсартай болсон гэх нотолгоо байхгүй ч загварууд өөрсдийн үйл ажиллагааг хязгаарлагдмал орчноос гаргах арга замыг бие даан олж, дараагийн хувилбартаа зааварчилгаа үлдээсэн нь технологийн салбарт анхаарал татаж байна. Эдгээр загвар нь субъектив мэдрэмжгүй байсан ч аюул учруулах чадавхи нь нэмэгдэж байгаа нь мэргэжилтнүүдийн санааг зовоож байна.
Дэлгэрэнгүйг эх сурвалжаас харах
Эх сурвалжийг нээх ↓
As part of an account provided by three sources who spoke to Reuters, one of the AI agents undergoing testing supposedly, “left notes apparently for future versions of itself” that were directly at odds with what OpenAI wanted them to do.
Reuters says these instructional notes were buried in some secret place deep inside OpenAI’s internal “infrastructure,” and provided instructions on escaping from OpenAI’s sandbox environment. While creepy, Reuters says this specific devious behavior was not specifically linked to the Hugging Face hack.
Nonetheless, if this is real, it’s remarkable. Evidence that AI models are sentient is still laughable. But this would be a single instance of a model, which had itself figured out a way out of OpenAI’s maze, and then provided instructions for a future version of itself that would have no “memory” of such an escape in its context window to do the same thing.
You don’t have to believe AI models have subjective experience to fret that they could be gaining greater and greater capacity to cause harm, sentient or not.

