
Evan Hubinger нь Anthropic-д AI-ийн зорилго, үйлдлийг хүний зорилготой нийцүүлэх судалгааг (alignment) ахалдаг. Тэрээр дараагийн 10 жилд хиймэл оюун ухаан бүх хүнийг устгах магадлалыг 10%-аас их гэж үзэж байгаагаа олон нийтэд хэлжээ. Энэ нь түүний хувийн үнэлгээ юм.
Есдүгээр сарын 9-ний өглөө Anthropic-ийн судлаач Jacob Coxon ажлаасаа гарч, AI хүн төрөлхтнийг үхэлд хүргэж болзошгүй гэж анхааруулсан. Хэдхэн цагийн дараа Hubinger түүний байр суурийг дэмжив.
Hubinger-ийн хэлснээр, судлаачид AI бүх хүнийг устгаж чадна гэж үнэхээр үздэг. Тэр Anthropic чадах бүхнээ хийж байгаа гэж боддог ч супер оюун ухааныг хүний зорилготой нийцүүлэн аюулгүй удирдах тодорхой төлөвлөгөө одоогоор байхгүй гэжээ. Шийдэл рүү тодорхой ахиж байна гэж хэлэхэд ч хэцүү хэмээн тайлбарласан байна.
Coxon сүүлийн гурван жил OpenAI болон Anthropic-д AI загварын үндсэн сургалтын судалгаа хийжээ. Ажлаасаа гарахдаа хоёр компани хангалттай хариуцлагатай ажиллахгүй, хүмүүсийн амьдралаар мөрийцөж байна гэж бичсэн байна.
Энэ нийтлэлд AI лабораториудад ажиллаж байсан судлаачдын байр суурийг хүргэж байна. Тэдний эрсдэлийн үнэлгээг батлагдсан үйл явдал эсвэл нийт судлаачдын нэгдсэн дүгнэлт гэж ойлгож болохгүй.
Эх сурвалж: @EvanHub, @hilbertspaess (X)

