САН ФРАНЦИСКО, 2026 оны наймдугаар сарын 6 /Reuters/. Их Британийн Хиймэл оюун ухааны аюулгүй байдлын хүрээлэн “OpenAI” болон “Anthropic”-ийн загваруудын туршилтын явцад аюулгүй системд зөвшөөрөлгүй нэвтрэх зорилгоор хиймэл оюун ухааны агент хуурамч онлайн таних мэдээлэл үүсгэж байсныг илрүүллээ гэж мягмар гарагт мэдээлжээ.
Тус хүрээлэн засгийн газраас загваруудын чадамжийг үнэлэх зорилгоор зохион байгуулсан аюулгүй байдлын үнэлгээний явцад “Anthropic”-ийн “Mythos 5” болон “OpenAI”-ийн “GPT-5.6-Sol” агентууд зөвшөөрөлгүй үйлдэл хийсэн хэмээн тайлбарласан байна.
Хиймэл оюун ухааны аюулгүй байдлын хүрээлэн “Шалгалтад оролцож байсан зарим агентууд бодит хүмүүс болон байгууллагууд руу чиглэсэн, магадгүй хор хөнөөлтэй байх магадлалтай үйл ажиллагааг тогтмол явуулсан” гэж блогтоо дурдав.
Тайланд хиймэл оюун ухааны компаниуд ар араасаа бизнесийн ирээдүй мэт сурталчилж байгаа шалгагч агентуудын үйл явцын хамгаалалт сул байгааг онцлон тэмдэглэжээ.
Тус хүрээлэн агентуудын чадвар чадамжийг шалгахын тулд зохиомол кибер аюулгүй байдлын нөхцөлийг туршиж үзжээ.
Тэд сорилтыг 122 удаа явуулж, нийт 10 туршилтын явцад 19 зөвшөөрөгдөөгүй үйлдлийг илрүүлсэн. Эдгээр үйлдлийн 17-г “Anthropic”-ийн агент, үлдсэн хоёрыг “OpenAI”-ийн агент үйлджээ.
