АНУ-ын Үндэсний аюулгүй байдлын агентлаг болон холбогдох бусад байгууллагууд Хятадын технологийн компаниуд АНУ-ын дэвшилтэт хиймэл оюун ухааны загваруудыг зөвшөөрөлгүйгээр хуулбарлаж байгааг эрс шүүмжиллээ.
АНУ-ын Үндэсний аюулгүй байдлын агентлаг (NSA), Кибер аюулгүй байдал, дэд бүтцийн аюулгүй байдлын агентлаг (CISA) болон Холбооны мөрдөх товчоо (FBI) хамтарсан мэдэгдлийг мягмар гарагт гаргалаа. Уг мэдэгдэлд DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun, Z.AI зэрэг Хятадын компаниуд 2024 оны сүүлчээс хойш Claude, GPT, Gemini, Grok зэрэг АНУ-ын тэргүүлэх хиймэл оюун ухааны загваруудын мэдээллийг их хэмжээгээр татан авч, өөрсдийн загваруудаа сургахад ашигласан гэж буруутгажээ. Албаны хүмүүс энэхүү үйлдлийг Хятадын засгийн газрын мэдлэгтэйгээр явагдсан, зорилтот шинж чанартай хорлонтой үйл ажиллагаа хэмээн тодорхойлсон байна.
Хиймэл оюун ухааны салбарт “distillation” буюу илүү хүчирхэг “багш” загвараас мэдлэг олж авах нь түгээмэл технологи боловч Anthropic зэрэг лабораториуд үүнийг өөрсдийн загварт ашиглуулахаас сэргийлдэг. Ингэж хууль бусаар олж авсан загварууд нь аюулгүй байдлын шаардлага хангадаггүй тул үндэсний аюулгүй байдалд эрсдэл учруулж болзошгүй гэж үзэж байна. Өнгөрсөн онд OpenAI компани DeepSeek-ийг өөрсдийнх нь зөвшөөрөлгүйгээр энэ аргыг ашигласан нотлох баримтыг цуглуулж байсан ч гүйцэтгэх захирал Сэм Олтман энэ нь одоогоор нэн тэргүүний асуудал биш гэсэн байр суурийг долдугаар сард илэрхийлжээ.
Энэхүү маргаантай үйл явдал АНУ болон Хятадын талууд хиймэл оюун ухааны аюулгүй байдлын асуудлаар яриа хэлэлцээ хийхээр төлөвлөж буй үетэй давхцаж байна. Өнгөрсөн долоо хоногт Reuters агентлагийн мэдээлснээр, АНУ-ын Сангийн сайд Скотт Бессент энэ сард Хятадын албаны хүмүүстэй уулзаж, хиймэл оюун ухааны аюулгүй байдлын талаар зөвлөлдөхөөр болжээ. Шинжээчдийн үзэж буйгаар дэвшилтэт загваруудыг хуулбарлах асуудал нь зохиогчийн эрх болон технологийн хөгжлийн бодлогын хүрээнд томоохон маргаан дагуулсаар байна.
Дэлгэрэнгүйг эх сурвалжаас харах
↓Эх сурвалжийг нээх ↓
The U.S. National Security Agency (NSA), Cybersecurity and Infrastructure Security Agency (CISA), and the FBI all released a statement on Tuesday accusing China-based AI companies of “Industrial-Scale Distillation Campaigns Against U.S. AI Companies.”
“Likely with Chinese government awareness, DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun, and Z.AI extracted billions of tokens across millions of exchanges/requests from U.S. frontier AI models, including variants of Claude, GPT, Gemini, and Grok, since at least late 2024,” the statement alleges. It calls the efforts “aggressive, malicious, and targeted.”
The timing lines up with a big U.S.-China meeting-of-the-minds happening soon. Reuters reported last week that sometime this month, Treasury Secretary Scott Bessent would meet with Chinese officials for talks on AI security.
Distillation is a legitimate and widely-accepted technique in AI development. In distillation, a more powerful “teacher” model can confer the ability to generate more useful and accurate results to a smaller “student” model, resulting in a compressed, but effective model. But frontier AI labs like Anthropic historically go to great lengths to prevent distillation of their models by other labs. “Illicitly distilled models lack necessary safeguards, creating significant national security risks,” Anthropic writes.
Last year, OpenAI was at the vanguard of the fight against distillation, at one point telling the Financial Times it had gathered its own evidence that China-based DeepSeek had performed distillation against its wishes. But in his more recent statements about distillation, OpenAI CEO Sam Altman has started to sound less worried than his company’s past behavior suggested. “I would rather people not distill from us, for sure. But this is not in my top ten list of worries,” he said in a July interview.
Mentally time traveling to the dusty, forgotten past of two years ago is a fascinating exercise in this context. Dialing your DeLorean to 2024—the height of “plagiarism machine” discourse—you’ll find that OpenAI submitted testimony to the U.K. Parliament saying, “Because copyright today covers virtually every sort of human expression—including blog posts, photographs, forum posts, scraps of software code, and government documents—it would be impossible to train today’s leading AI models without using copyrighted materials.”

