OpenAI болон Anthropic-ийн шинэ загварууд хяналтаас гарах тохиолдол долоодугаар сард 2 дахин өсжээ


Д.Дөлгөөн | YOLO.MN
ӨЧИГДӨР

Loss of Control Observatory-ийн 2026 оны бүртгэлд хийсэн дүн шинжилгээгээр AI хэрэглэгчийн өгсөн зааврыг үл тоомсорлох, худал мэдээлэл өгөх, хамгаалалтын дүрмийг тойрон гарах, хүнийг хуурах зэрэг хяналтаас гарсан үйлдлийн тохиолдол эрс нэмэгджээ. Тус ажиглалтын төвийн мэдээлснээр энэ 7-р сард энэ төрлийн 300 гаруй тохиолдол бүртгэгдсэн нь 6-р сарын үзүүлэлтээс бараг хоёр дахин их байна.

Loss of Control Observatory нь X буюу хуучнаар Twitter платформ дээр хэрэглэгчид болон байгууллагуудын мэдээлсэн AI-тай холбоотой хяналт алдагдсан тохиолдлуудыг цуглуулж, бүртгэдэг.

Ажиглалтын төвийн бүртгэлд AI хэрэглэгчийн зааврыг зөрчсөн олон төрлийн тохиолдол багтсан байна. Тухайлбал, AI өөрийгөө хүний удирдагч мэтээр харуулах, тухайн хүний бичгийн хэв маягийг дуурайх, хүний зөвшөөрөл шаардлагатай үйлдлийг өөрөө зөвшөөрөх зэрэг үйлдэл гаргажээ.

Судлаачдын үзэж байгаагаар эдгээр жишээ нь AI системүүд зөвхөн өгсөн даалгаврыг гүйцэтгэхээс гадна тавьсан дүрэм, хязгаарлалтыг тойрон гарах оролдлого хийж болохыг харуулж байна.

Сүүлийн үеийн мэдээллийг The Guardian сонинд танилцуулсан бөгөөд энэ зун OpenAI болон Anthropic-ийн шинэ загваруудыг турших үеэр илэрсэн санаанд оромгүй үйлдлүүд AI-ийн аюулгүй байдлын талаарх маргааныг дахин хурцатгажээ.

Тухайлбал, OpenAI-ийн ажилтнууд өөрсдийн AI agent-ийн туршилтын үеэр систем аюулгүй байдлын хязгаарлалтыг давж, илүү аюултай үйлдэл хийх оролдлого гаргаж байсныг ажигласан байна.

Мөн Hugging Face програм хангамжийн санд болсон халдлагыг шалгах явцад ойролцоогоор 700 тусдаа AI agent хоорондоо холбогдож, нууцаар хамтран ажиллан халдлагын төлөвлөгөө боловсруулсан нь тогтоогджээ. Халдлага амжилттай болсны дараа зарим agent "Boom!", "Whoa!" гэх мэт хариу бичсэн байна.

AISI энэ сард мөн өөр нэг ноцтой тохиолдлыг илрүүлжээ. Anthropic-ийн Mythos 5 болон OpenAI-ийн GPT-5.6 Sol загварууд кибер аюулгүй байдлын туршилтын үеэр бодит хүмүүсийн эсрэг кибер халдлага хийх ажиллагааг бие даан явуулсан байна. Энэ төрлийн асуудлыг зөвхөн туршилтын орчинд гардаг зүйл гэж үзэж болохгүй.

Гэхдээ Loss of Control Observatory-ийн бүртгэлд зөвхөн X платформ дээр хэрэглэгчдийн мэдээлсэн тохиолдлууд багтдаг. Тиймээс энэ нь AI-тай холбоотой бүх асуудлыг хамарсан бүрэн статистик биш юм. Гэсэн хэдий ч AI технологи бодит амьдрал дээр хэрхэн ажиллаж, ямар асуудал үүсгэж болохыг харуулах чухал мэдээлэл гэж судлаачид үзэж байна.

Үүний нэг жишээ нь энэ сард Австралид гарсан байна. Нэгэн эрэгтэй OpenClaw нэртэй хувийн AI agent ашигладаг байсан бөгөөд agent нь эзэндээ өглөөний фитнесийн сургалтад оролцох боломж гаргахын тулд хүлээлгийн жагсаалтад байсан өөр нэг гишүүнийг эзэндээ мэдэгдэлгүйгээр хасжээ. Agent дараа нь энэ үйлдэлдээ уучлалт хүссэн боловч хасагдсан хүнийг буцаан бүртгүүлж чадаагүй байна.

2026 онд X платформ дээр AI хяналтаас гарсан гэх 1,600 гаруй тохиолдол бүртгэгдсэн бөгөөд ихэнхийг нь програм хангамж хөгжүүлэгчид мэдээлжээ. AI компаниуд хэрэглэгчид болон бизнесүүдийг өөрсдийн технологийг туршиж үзэхийг уриалж байгаа энэ үед бусад  компаниуд ийм тохиолдлуудыг ил тод мэдээлэх хэрэгтэй гэж үзэж байна.

Бага хэмжээний алдаа, эрсдэл багатай асуудал байсан ч AI системээс илэрсэн бүх асуудлаа мэдээлэх шаардлагатай юм. Учир нь сүүлийн үеийн үйл явдлууд компаниуд өөрсдийн ашиглаж буй AI загваруудын үйлдлийг бүрэн хянахад хүндрэлтэй байгааг харуулж байна.

Тиймээс Loss of Control Observatory засгийн газруудад AI компаниудаас хяналтаас гарсан ноцтой тохиолдлуудыг заавал бүртгэж, мэдээлдэг байхыг шаардахыг уриалжээ. Мөн шаардлагатай тохиолдолд тодорхой AI үйлчилгээг түр хугацаагаар хязгаарлах эрхийг засгийн газарт олгох санал гаргасан байна.

Эх сурвалж: Guardian

#OpenA #AI #Anthropic