Бид AI Academy Asia-тай хамтран хиймэл оюуны тухай хамгийн сор болсон эсээнүүдийг орчуулан хүргэж байгаа билээ. Өмнө нь Билл Гэйтсийн эсээг орчуулан хүргэсэн бол энэ удаад Anthropic-ийн Гүйцэтгэх захирал Дарио Амодейгийн сүүлийн хэд хоногт трэнд болоод буй эсээг хүргэж байна. 

Холбоотой нийтлэл: Билл Гэйтс: Хиймэл оюуны түйвээнтэй эрин ирлээ, одоо ямар сонголт хийх нь бүхнийг шийднэ

AI Academy Asia-гийн зарласан шинэхэн хөтөлбөрүүдийн мэдээллийг эндээс аваарай.

Ингээд 2026 оны 9-р сарын 12-нд darioamodei.com веб дээр нийтлэгдсэн, Claude-ийг хөгжүүлэгч Anthropic-ийн Гүйцэтгэх захирал Дарио Амодейгийн "Бид хиймэл оюуны хөгжлийн хурдыг сааруулах ёстой" эсээний бүрэн орчуулгыг хүлээн авна уу.


ТЭРГҮҮН ЭГНЭЭНИЙХЭН ХУРДАА ТААРУУЛАХ ХЭРЭГТЭЙ

Миний бие уг технологи хүний амьдралын чанарыг эрс дээшлүүлж чадна гэж итгэдэг учраас сүүлийн 12 жил хиймэл оюун (artificial intelligence, товчоор AI) дээр ажиллаж байна. Энэ технологийн гайхалтай ашиг тусын талаар олон удаа бичсэн. Хиймэл оюун ирэх 5-10 жилд томоохон өвчний ихэнхийг эмчилж, эдийн засгийн өсөлтийг эрс хурдасгаж, элбэг хангалуун, боломжоор дүүрэн ертөнц бүтээж, ардчилал, эрх чөлөөний сэргэн мандалтыг авчирна гэж боддог. Тэр ирээдүй хурдан ирээсэй ч гэж бодож байна. Учир нь аавын минь амь насыг авч одсон өвчний эмчилгээ нас барснаас нь хэдхэн жилийн дараа олдсон юм. Би өөрөө ч 50 жилийн өмнө бол эмчлэх ч боломжгүй байсан хорт хавдрын эхний шатыг даван туулсан. Болгоомжтой ашиглаж чадвал хиймэл оюун хүн төрөлхтний амьдралыг ахиулж ирсэн гайхамшигт технологиудын нэг нь байх болно.

Гэвч өмнөх олон технологийн адил хиймэл оюун ч эрсдэл дагуулж буй бөгөөд хүчирхэг технологи учраас эрсдэл нь ч ноцтой. Тэдгээрийн талаар ч би бас их бичсэн. Тэр дотор хиймэл оюуны системд хяналтаа алдах эрсдэл, кибер халдлага, био терроризмд хиймэл оюуныг урвуулан ашиглах, эдийн засгийн ноцтой хямрал зэрэг багтана. Зөвхөн ашиг орлогод чиглэсэн ёроол руу уралдах уралдаан эдгээр эрсдэлийг улам хурцатгаж мэднэ.

Антропикийн (Anthropic) эхэн үеэс л хамтран үүсгэн байгуулагч, ажилтнуудынхаа хамт би энэхүү технологийн аюул эрсдэл, ашиг тус гэсэн хоёр шинжтэй тэмцсээр ирлээ. Уг технологийг огт хөгжүүлэхгүй бол хүн төрөлхтөн ашиг тусыг нь үл хүртэнэ. Эсвэл өөр нэг нь хөгжүүлээд дарангуйлагчдын гарт орчихож мэднэ. Мөн хэтэрхий хурдан бүтээх нь ч хайхрамжгүй хэрэг. Тиймээс л бид дундын замыг эрсэн юм. Анхаарал болгоомжтой бүтээхийн зэрэгцээ ашиг орлого олж, мөн арилжааны амжилтад хүрэх боломжтойг харуулж, аюулгүй байдлыг хиймэл оюуны компаниудын өрсөлддөг талбар болгоход анхаарсан хэрэг. Өөрөөр хэлбэл оргил руу чиглэсэн уралдаан үүсгэх гэж оролдсон юм. Бид хүчин чармайлтынхаа ихээхэн хэсгийг эрсдэлийг судлах, шийдвэрлэх, олон нийтэд мэдээлэх, түүнчлэн хиймэл оюуны сайтар бодож боловсруулсан зохицуулалтыг дэмжихэд зориулж ирсэн. Үүнийхээ төлөө хий хөөрөгдөл, «сүйрлийн номлол» дэлгэрүүлж байна, эсвэл зохицуулалтыг гартаа атгах гэж байна гэж шүүмжлэлд өртөж ч явлаа. Бид хурдаас илүү болгоомж, ашгаас илүү ухаалаг байдлыг эрхэмлэхийг хичээсэн.

Гэвч сүүлийн хэдэн сард эрсдэлийг бүрэн шийдвэрлэхэд урьд өмнөхөөсөө ч илүү ухаалаг байх хэрэгтэй гэдэг нь харагдах боллоо. Зөвхөн эрсдэлээс сэргийлэхэд хөрөнгө оруулаад зогсохгүй, сэргийлэх ажилд гүйцэх хугацаа өгөхийн тулд чадвар дэвших хурдыг нь сааруулах хэрэгтэй. Бид хиймэл оюуны чадварыг сайжруулах хурдаа сааруулах ёстой. Дэвшил мэдээж явагдах ч бид өөрсөддөө цаг хугацаа бий болгож, тэрхүү цаг хугацаагаа ухаалгаар зарцуулах учиртай. Ингэж итгэхэд нөлөөлсөн хоёр зүйл бий.

Миний эхний санаа зовнил бол энэ зунаас эхлэлтэй хиймэл оюуны асар хурдтай хөгжил. Үүнийг голчлон хөтөлж буй зүйл нь хиймэл оюун дараагийн үеийн хиймэл оюуныг өөрөө бүтээх чадвартай болсон явдал. Энэ үзэгдлийг өөрийгөө давтан сайжруулах (recursive self-improvement) гэж нэрлэдэг бөгөөд Антропикийг оруулаад салбар даяар ийм үзэгдэл гарч байна. Хяналтгүй орхивол энэ нь бидний ойлгох, хянах чадвараас ч түрүүлж мэднэ. Тиймээс хэрэв үнэхээр л хөгжүүлье гэвэл маш болгоомжтой хандах хэрэгтэй.

Миний хоёр дахь санаа зовнил бол OpenAI, Hugging Face хоёрын хооронд болсон явдал (OAI-HF) юм. Агентуудын сүрэг нэгдэн нийлж, өөрсдөөс нь огт шаардаагүй, гүйцэтгэж буй ажилтай нь ямар ч холбоогүй бай руу кибер халдлага үйлдэж, бүлгийнхээ амжилтын төлөө өөрсдийгөө золиослож, гүйцэтгэлийг нь үнэлэх үүрэгтэй «дүгнэгч» рүү нэвтрэхийг оролдсон. Хэн ч гэмтээгүй, эдийн засгийн хохирол багатай байсан тул энэ явдлыг үл тоох амархан. Гэвч миний бодлоор илүү өндөр чадвартай агентууд тийнхүү аашлах юм бол гамшиг тохиох байлаа. Хиймэл оюуны чадвар нэмэгдэж буй хурдаас харахад 6-12 сарын дотор ийм сүрэг агентууд интернэтийг тэр чигт нь эзэлж чадах болов уу гэж эмээж байна. Тэгвэл тэд хэдэн зуун тэрбум долларын хохирол учруулж мэднэ. Хэрэв хиймэл оюун зохих хамгаалалтын хашлагагүйгээр улам хүчирхэг болсоор байвал хохирлын хэмжээ цаашид улам нэмэгдсээр байх болно. Энэ явдлыг нэг компанийн алдаа гэж үзэж болох ч тэгж дүгнэх нь буруу гэж бодож байна. Үүнтэй төстэй ч хохирол багатай явдал Антропикийг оруулаад салбар даяар л тохиолдсон. Тиймээс тэргүүн эгнээний хиймэл оюуны компани бүр энэ явдал өөрт нь тохиолдсон мэтээр хандах ёстой гэж бодож байна.

Тиймээс би тэргүүн эгнээний хиймэл оюуны хурдыг сааруулах гурван алхамт төлөвлөгөө дэвшүүлж байна. Ингэснээр бид хиймэл оюуны аюулгүй байдлыг хангаж, ашиг тусыг нь хүртэхийн зэрэгцээ геополитикийн томоохон асуудлуудтай нүүр тулах боломжтой юм. Хурдаа сааруулна гэдэг нь загварын сургалт, техникийн дэвшлийг зогсоохыг хэлэхгүй. Харин компаниудад өөрсдийн загварын аюулгүй байдлыг хангахад хангалттай цаг өгөх, тэгж чадсан эсэхийг нь гуравдагч талын үнэлгээгээр баталгаажуулж байхыг хэлж байгаа юм. Манай компанийн хувьд хурдаа сааруулах нь аюулгүй байдлын амлалтаа улам бэхжүүлж, оргил руу чиглэсэн уралдааныг дэмжих оролдлого юм. Энд дурдах эхний алхмыг Антропик дангаараа үүрч байгаа бөгөөд тэргүүн эгнээний бусад компаниас үүнийг шаардахыг засгийн газруудаас хүсэж байна. Хоёр дахь алхамд салбар даяарх уялдаа шаардлагатай. Үүнд засгийн газрын зуучлал эсвэл монополийн эсрэг хязгаарлалтаас чөлөөлөлт хэрэгтэй. Харин гурав дахь алхамд дэлхийн хэмжээний уялдаа шаардлагатай. Эдгээр алхмыг заавал дараалан хийх албагүй бөгөөд аль нэг нь нөгөө хоёроосоо хамаагүй бэрх байж мэднэ. Гэхдээ цаашид бид юун дээр анхаарах талаар бодоход эдгээр алхмууд надад ач тусаа өгсөн юм. Миний санал болгож буй алхмууд нь:

• Суурин үнэлгээчид: Тэргүүн эгнээний хиймэл оюуны компани бүр дотроо суурьшуулах гуравдагч талын үнэлгээчдийн багт (тухайлбал METR) өөрсдийнхөө ажилтантай ижил хэмжээний эрх нээж өгөхөө амлах хэрэгтэй. Тэдгээр үнэлгээчдийн үүрэг бол аюулгүй байдлын журам, амлалтаа мөрдөж байгааг шалгах, тохиолдлыг мэдээлэх, түүнчлэн зөвхөн бэлэн болсон загвар төдийгүй сургалтын дамжлага, нийцүүлэлтийг (alignment) үнэлэхэд туслах явдал. Хурдаа сааруулах аливаа амлалтыг баталгаажуулах гол алхам нь энэ бөгөөд банкны салбарт ийм жишиг бий. Зохицуулагчид ажилтнуудын хамт компани дотор ажилладаг. Антропик энэ алхмыг одоогоор дангаараа үүрч байна. Үүнийг бид аюулгүй байдал, нийцүүлэлтийн ажлаа хоёр дахин эрчимжүүлэх өргөн хүрээний хүчин чармайлтын нэг хэсэг болгох бодолтой байна.

• Ардчилсан холбоо: Ардчилсан орнуудын тэргүүн эгнээний хиймэл оюуны компаниуд аюулгүй байдлын нийтлэг стандарт, түүнчлэн хараа хяналтгүй дэвшлийн хурдны хязгаарыг хамтдаа тогтоох хэрэгтэй. Хурдаа сааруулахад чухал нөлөөтэй зарим ажил эрх зүйн хувьд төвөгтэй тул засгийн газрын дэмжлэг шаардана.

• Дэлхийн хамтрал: АНУ болон бусад ардчилсан улсын засгийн газар дарангуйлагч засгийн газартай боломжийнхоо хэрээр хамтрахыг оролдох хэрэгтэй. Мөн хэрэгжилтийг шалгах бэрхшээлийг нухацтай авч үзэх ёстой.
Эссэний үлдсэн хэсэгт би эдгээр алхам тус бүрийг тайлбарлана. Гэхдээ эхлээд хурдаа сааруулах нь хиймэл оюуны хөгжүүлэлтийн явцыг яг яаж илүү аюулгүй болгохыг хэлэх нь чухал болов уу. Хурдаа сааруулахыг үр дүнгүй хий хоосон дасгал болгоход эрсдэл нь дэндүү өндөр. Бидэнд олдох цаг хугацааг ухаалгаар ашиглах хэрэгтэй.

Яагаад хурдаа сааруулах ёстой вэ?

Хиймэл оюуныг түр зогсоох буюу удаашруулах санаа 2023 оноос хойш яригдаж ирсэн бөгөөд тэр үед тийм ч ач холбогдолгүй байлаа. «Хурдаа удаашрууллаа ч олсон цагаараа юу хийх вэ?» гэдэг асуулттай тулгардаг байв. Тэр үеийн хиймэл оюуны загварууд бие даасан агент болж утга учиртай үйлдэл хийх хэмжээнд хүчирхэг байгаагүй бөгөөд хууран мэхлэх, удирдан жолоодох, заль мэх хэрэглэх, кибер халдлага хийх ч чадваргүй байв. Тэдний нийцүүлэлтийн эрсдэлийг шийдвэрлэхийн тулд удаашруулна гэдэг нь бактери дээр туршилт хийж хүний сэтгэл зүйг судлах гэж оролдож байгаатай адил санагдана. Гэтэл өнөөдөр дүр зураг тэс өөр байна. Одоогийн загварууд хиймэл оюуныг хэрхэн сайн бүтээх вэ, муу бүтээвэл юу нь буруудаж мэдэх тухай мэдлэгийн алтны уурхай болж байна. Хэрэв хурдаа удаашруулах нь хиймэл оюуны загваруудын чадвар эгзэгтэй түвшинд хүрэхээс өмнө бидэнд ганц хоёр жилийн нэмэлт хугацаа олгож, тэрхүү хугацааг бид аюулгүй байдалд зарцуулбал ноцтой зүйл болох эрсдэлийг эрс бууруулж чадна гэдэгт итгэлтэй байгаа. Олон талыг хамруулсан, хурдаа сааруулах стратеги нь тэргүүн эгнээний хөгжүүлэгчдэд ашиг орлогын давуу тал, АНУ-ын хиймэл оюун дахь тэргүүлэх байр суурийг золиослохгүйгээр энэ чухал ажлыг хийх цагийг өгнө. Илүү өргөнөөр авч үзвэл энэ технологийг хэрхэн ашиглах талаар нийгэм өөрөө үг хэлэх ёстой. Хурдаа сааруулж, зайлшгүй хэрэгтэй олон нийтийн хэлэлцүүлэгт илүү их цаг гарах нь эргэлзээгүй сайн хэрэг.

Тодруулбал, хурдаа удаашруулах нь компаниудад дараах чиглэлд илүү анхаарч, илүү их нөөц зарцуулах боломж олгоно. Эдгээр нь Антропикийн хувьд аль хэдийн тэргүүлэх зорилт болоод байгаа:

• Үйл ажиллагааны төгөлдөржилт: Өдгөө хиймэл оюуны загварыг сургаж, нэвтрүүлэх нь мянга мянган хүн, сая сая чип, технологийн түүхэн дэх хамгийн нийлмэл дэд бүтцийг хамарсан асар том зохион байгуулалтын ажил. Алдаа мадаг гарах нь компанид ямар нэг чухал онол, ойлголт дутсандаа биш, харин гүйцэтгэлийн асуудлаас үүдэлтэй байдаг. Жишээ нь бидний сүүлд мэдээлсэн нийцүүлэлтийн доголдол бататгах сургалтын орчныг дутуу дулимаг шүүснээс үүдэлтэй байж болох тал бий. Манай хамт олон болон манай нийлүүлэгчид үүнийг нэлээд хичээнгүйлэн хийсэн ч хангалттай сайн хийж чадаагүй юм. Хяналт, тусгаарлагдсан орчин, сургалтын орчны цэвэр байдал, өгөгдлийн асуудал гэдэг бол үйл ажиллагааны доголдол дахин дахин гарсаар байдаг туйлын нийлмэл салбар. Эдгээр ажил үүрэг тус бүрийг хийх дэлхийн хамгийн чадварлаг баг бидэнд бий. Гэвч нэг дор хийх зүйлс дэндүү их байна. Илүү тогтвортой хурдаар ажилласнаар бид үйл ажиллагааны хувьд хамаагүй өндөр түвшинд хүрч чадна. Хүн төрөлхтөнд онгоцны нислэг тэргүүтэй технологийн хувьд нийлмэл, аюулгүй байдлын өндөр ач холбогдолтой системийг сая сая удаа ямар ч осолгүй ажиллуулсан бодит туршлага бий. Гэхдээ ийм түвшинд хүрэхэд цаг хугацаа шаардагдана.

• Нийцүүлэлт: Нийцүүлэлтийн чиглэлд бид тодорхой ахиц гаргаад байна. Өөрөөр хэлбэл загвараа аюулгүй, ёс зүйтэй, бидний журамд нийцсэн, үнэхээр тустай байлгахаар сургаж чадсан. Эдгээр зарчим нь Claude загварын Үндсэн хуульд шингэсэн байдаг. Гэвч нийцүүлэлтийн сургалт маань загварын чадварын өсөлтийг гүйцэж байхын тулд хийх зүйл их үлдсэн. Хүсээгүй зан төлөвийн жишээ одоо ч хааяа гарсаар байна. Хурдаа сааруулах нь манай судлаачдад нэмэлт цаг өгч, эдгээр асуудлын шалтгааныг илүү сайн ойлгож, урьдчилан сэргийлэх илүү сайн арга боловсруулахад тус болно.

• Тайлбарлах чадвар: Хиймэл оюуны загварын дотор юу болж байгааг ойлгох шинжлэх ухаанд сүүлийн хэдэн жилд асар том ахиц гаргасан бөгөөд энэ нь загвараа нийтэд гаргахын өмнө аудит хийхэд улам чухал үүрэг гүйцэтгэж байна. Үүнийг бараг л хиймэл оюуны «тархи» дээр ашиглаж fMRI шинжилгээ гэж хэлж болно. Энэ шинжилгээ аливаа зан төлөвийн цаад шалтгааныг харахад тусална. Жишээ нь бидний шалгаж буй сүүлийн үеийн нийцүүлэлтийн алдаанууд дээр үг болоогүй сэдлийг судлахдаа бид тайлбарлах чадварын аргыг ашигласан. Гэвч эдгээр арга үргэлж тодорхой, найдвартай үр дүн өгдөггүй. Бүх ахицыг үл харгалзан эдгээр загварын дотор болж буй зүйлийн өчүүхэн хэсгийг л бид ойлгож байна. Тайлбарлах чадварын аргаа сайжруулах хүчин чармайлт, одоогийнхоос хурдан явбал 1-2 жилийн дотор маш сайн ахиц гаргаж чадна. Түүнчлэн аль хэдийн гарсан алдаа дутагдал дээр суурилсан туршилтын материал элбэг байгаа.

• Сорил ба үнэлгээ: Хиймэл оюуны загварын чадвар өсөх тусам сорил, үнэлгээ хийх улам л бэрх болно. Загвар ухаалаг байх тусмаа аливаа сорилыг мэхлэх чадвар нь нэмэгдэх тул ноцтой асуудалтай загварууд ч асуудалгүй мэт харагдаж мэднэ. Өргөн хүрээнд ухаалгаар зохиосон үнэлгээний цуглуулга бүрдүүлж, тэдгээрийг дахин шалгах тайлбарлах чадварын шинжилгээтэй хослуулах нь тун чухал бөгөөд үүнд 1-2 жилийн дотор багагүй ахиц гаргаж болно.

Суурин хөндлөнгийн үнэлгээчид

Антропикийн дангаараа хийж буй гурван шатат төлөвлөгөөний эхний алхам бол аюулгүй байдлын журмыг шалгаж, алдаа дутагдлыг мэдээлэх ажилтантай адил байр суурьтай суурин хөндлөнгийн үнэлгээчид юм.

Үнэлгээчдийг компани дотроо байлгана гэдэг ач холбогдолгүй алхам мэт сонсогдож мэднэ. Гэвч хамгийн уйтгартай, хамгийн албаны сонсогддог зүйлс үнэндээ хамгийн чухал нь байх нь олонтаа. Суурин үнэлгээчид гэдэг бол өнөөдөр ямар ч хиймэл оюуны компанийн хийж байгаагаас хамаагүй дэвшилтэт, эрс шинэчлэл бөгөөд дараах ач холбогдолтой:

• Баталгаажуулалт: Хиймэл оюуны компани сургалт, нэвтрүүлэлт, үйл ажиллагаа, хамгаалалтын чиглэлд мөрдөж байгаа гэж хэлж буй журмаа үнэхээр мөрдөж байгаа эсэхийг суурин үнэлгээчид эрэг шураг болгоных нь түвшинд шалгаж чадна. Хурдаа сааруулах аливаа амлалт олон тодорхойгүй зүйл, «хуулийн үсэг чухал уу, хуулийн сүнс чухал уу» гэсэн маргаан дагуулна. Тиймээс нарийн ширийнийг нь үнэхээр харж чадах төвийг сахисан гуравдагч тал байх нь гарцаагүй чухал.

• Ил тод байдал: Бид ямар ч амлалт өгсөн бай, юу болж байгаа талаар олон нийт мэдэх эрхтэй. Антропик ил тод байдлыг эртнээс дэмжиж ирсэн. Салбарын ихэнх нь зохицуулалтын эсрэг байхад бид ил тод байдлын хуулийг дэмжсэн бөгөөд манай загваруудын тайлбар, эрсдэлийн тайлан хэдэн зуун хуудас болдог. Гэвч юуг оруулж, юуг орхихыг бид одоо ч өөрсдөө сонгодог. Суурин үнэлгээчид энэ байдлыг өөрчилнө.

Нэмэлт санал: Албан ёсны амлалтыг шалгаж, олон нийтэд мэдээлэхээс гадна суурин үнэлгээчид бизнесийн сонирхлоос ангид нэмэлт саналыг гаргаж чадна. Ажилтнуудын огт бодож үзээгүй, гэхдээ байгаа гэдгийг нь мэдвэл дуртайяа засах зүйлийг үнэлгээчид зааж өгснөөр аюулгүй байдалд багагүй дэвшил гарч болох юм.
Ийм ач холбогдолтой учраас хурдаа сааруулах аливаа санал суурин үнэлгээчдээс эхэлбэл хамаагүй өндөр үр дүнтэй байх магадлалтай.

Эдгээр суурин үнэлгээчид ижил төстэй эрсдэлийн үнэлгээ хийдэг дотоод ажилтнуудынхтай адил байнгын эрх мэдэлтэй байх ёстой. Тухайлбал Антропик дараах бүх зүйлээр хангагдсан суурин хөндлөнгийн хяналтын багийг ойрын хугацаанд урих бодолтой байна:

• Манай оффис дахь ширээ, нэвтрэх карт, компанийн зөөврийн компьютер.

• Дотоод эрсдэлийн үнэлгээний багийнхтай адилхан ажлын орчин, багаж хэрэгсэл, нэвтрэх эрх. Мэдээж тодорхой хууль, гэрээгээр шаардсан зүйлс эсвэл харилцагч, түншийн хувийн мэдээллийг хамгаалахын тулд зарим хязгаарлалт тогтооно. Мөн хяналтын багийнхныг ажилтнуудтай шууд ярилцах зэргээр холбогдох мэдээлэлд хандахыг дэмжсэн дотоод хэм хэмжээ тогтоох болно.

• Дээр дурдсан ярвигтай асуудлуудыг тэнцвэржүүлсэн гэрээ. Хөндлөнгийн хяналтын баг эрсдэлийн түвшин, алдаа дутагдал, түүнчлэн юунд хандаж чадсан, юунд хандаж чадаагүй тухай дүгнэлтээ Антропикийн редакцын хяналтгүйгээр нийтлэх эрхтэй байх ёстой. Мэдээж аюулгүй байдалд эмзэг, хуулиар хамгаалагдсан, арилжааны нууц, гуравдагч талын нууц мэдээллийг хасах эрх бидэнд байна. Гэхдээ зүгээр таагүй санагдсан болохоор нь дүгнэлтийг хасах эрх бидэнд байхгүй. Хэрэв хассан зүйл дүгнэлтэд нь чухал байсан бол хяналтын баг үүнийг олон нийтэд хэлж болно.

Компанийн хувьд энэ бол ер бусын алхам. Гэвч бид хөндлөнгийн хяналтын үзэл санааг бодит болгож харуулах нь чухал гэж үзэж байна. Дахин хэлэхэд тэргүүн эгнээний бусад компанийг ч энэ жишгийг дагаарай хэмээн уриалж байна.

Ардчилсан орнууд дотооддоо хурдаа сааруулах нь

АНУ-ын хиймэл оюуны компаниудын дийлэнх хэсэгт суурин үнэлгээчид ажиллаж эхэлсний дараа хурдаа сааруулах үйл явц илүү бодитой болно.

Тухайлбал загвар, сургалтын дамжлагын нарийн шинж чанарт тулгуурлан хурдаа сааруулах боломжтой болно.
Хурдаа сааруулах хамгийн үр дүнтэй арга бол АНУ-ын тэргүүн эгнээний бүх компанийг хамарсан зохицуулалт. Сайн дураар хамтрах хүсэлгүй компаниудыг ч хамруулах хэрэгтэй. Антропик ухаалаг, оновчтой зохицуулалтыг, тодруулбал ил тод байдал, гуравдагч талын аудитад чиглэсэн хуулийн төслийг эртнээс дэмжиж ирсэн. Би тэргүүн эгнээний бүх лаборатори засгийн газартай түншилж, суурин үнэлгээчдийн үзэл санааг албажуулах ёстой гэж боддог. Ингэснээр сүүлийн хэдэн сард тохиолдсон шиг үйл ажиллагааны алдаа мадгаас илүү сайн сэргийлж, баримтжуулж чадахаас гадна хиймэл оюуны загварын ур чадвар, аюулгүй байдлыг тэнцвэртэй байлгахад чиглэсэн ажлууд хийх боломж бүрдэнэ.

Харамсалтай нь хууль батлахад цаг хугацаа ордог ч хиймэл оюун маш хурдан дэвшиж байна. Тиймээс зохицуулалтын замтай зэрэгцээд хиймэл оюуны компаниуд сайн дураараа хамтарч стандарт тогтоох ёстой. Суурин үнэлгээчид байснаар энэ ажил илүү урагштай байж чадна. Монополийн эсрэг хууль тогтоомжийн улмаас эдгээр хэлэлцүүлгийг АНУ-ын засгийн газар зохицуулж, эсвэл ядаж боломж олгож өгвөл тустай. Тэд оролцох шаардлагагүй, харин аюулгүй байдлын тодорхой яриа хэлэлцээрийг тодорхой хүрээнд чөлөөлөх хэрэгтэй. Энэ яриа хэлэлцээр засгийн газартай холбоо бүхий салбарын холбоодоор дамжин явагдаж ч болно. Жишээ нь Демис Хассабисын (Demis Hassabis) санал болгосон механизм ч байж болно. Аль ч замаар явсан бай, ийм хэлэлцүүлэг хурдан л урагшлах ёстой болоод байна.

Ерөнхийдөө, би тухайн тэргүүн эгнээний систем юу хийж чадаж байгаа, түүнийг бид хэр аюулгүй гэж ажиглаж байгаад тулгуурлан хурдаа сааруулах санааг хамгийн их дэмждэг. Жишээ нь «хяналтын цэг»-ийн цуваа гэсэн нэг боломжит схем байж болно. Хэрэв загвар X чадвартай бол Y, Z гэсэн нийцүүлэлтийн шинж чанарын гэрчилгээ дагалдах ёстой. Тэдгээр гэрчилгээ нь үнэлгээ, тайлбарлах чадварын шинжилгээ, сургалтын орчны аудитын аль нэг хослол байж болно. Энэ жишээнд X нь «загвар нь түгээмэл тусгаарлах аргын ихэнхээс зугтаж, эсвэл давж чадна» байж болох бол Y нь загвар орчноосоо гарч, олон тооны компьютер эзлэх хандлагатай байх магадлалыг маш бага болгоход шаардагдах бүх хүчин зүйлс байж болно.

Мөн тэргүүн эгнээний загварт ордог орцыг хязгаарлах, тухайлбал сургалтын тооцоолох хүчин чадал, сургалтын шинж чанар, эсвэл хиймэл оюуныг сайжруулахад хиймэл оюуныг дотооддоо ашиглахыг хязгаарлах замаар хурдаа сааруулахыг авч үзэх хэрэгтэй. Эдгээр арга хэмжээний зарим нь гаднах зан төлөвөөс илүү «тойрч гарахад амархан» байж мэдэх л юм. Яг ийм сэдвийг суурин үнэлгээчидтэй хэлэлцэх нь зүйтэй. Ардчилсан орнууд дотроо хурдаа сааруулах боломж нь АНУ-ын компаниуд дарангуйлагч дэглэмээс, голчлон Хятадын Коммунист Намаас хэр түрүүлж байгаагаар хязгаарлагдана. Хэрэв бид Хятадын компаниуудаас удаан хөдлөх юм бол тэдний төслүүд түрүүлж, үндэсний аюулгүй байдлын ноцтой эрсдэл үүснэ. Хиймэл оюуны салбарт Хятад тэргүүлэх нь АНУ болон дэлхийд ноцтой аюул учруулна гэсэн сайд Бессентийн (Secretary Bessent) санал надад ч үнэний ортой санагддаг. Коммунист Намтай холбоотой төслүүд АНУ-ын компаниудын болгоомжилж буй тэр л эрсдэлийг дагуулах болно. Тэдгээр эрсдэлээс зайлсхийлээ ч гэсэн тэдний хөгжил давамгайлж, хиймэл оюунаар удирддаг нисгэгчгүй онгоц гэхчлэн тэд цэргийн хүчээр ардчилсан улсаас давуу байх болно. Тиймээс ардчилсан орнуудын хувьд хурдаа сааруулахдаа хиймэл оюун дахь тэргүүлэх байр сууриа дарангуйлагч дэглэмд алдахгүй байхын зэрэгцээ хөгжүүлэгч бидэнд амьсгаа авах хангалттай орон зайг өгөх ёстой.

Өрсөлдөөний давуу талаа хамгаалахын тулд бидний хийж чадах гол алхам:

• Хүчирхэг хиймэл оюуны чип, хагас дамжуулагч үйлдвэрлэлийн тоног төхөөрөмжийг Хятадад бүү зар. Мөн чип хууль бусаар нэвтрүүлэх үйл ажиллагаа, Хятадын гадна байрлах дата төвд алсаас хандах явдалтай хатуу тэмцэх хэрэгтэй. Хятадын хиймэл оюуны хүчийг голлон тодорхойлох зүйл нь чип байх болно.

• Дарангуйлагч орны компаниуд тэргүүн эгнээний загварын хариултаар өөрсдийн загвараа зөвшөөрөлгүй сургах буюу дистилляци хийхийг хатуу таслан зогсоох хэрэгтэй. Ийм аргаар хоцорсон компаниуд бие даан хөгжүүлэхэд шаардагдах зардлын багахан хэсгээр зөрүүгээ нөхөж чаддаг.

• Хиймэл оюуны компаниудын аюулгүй байдлыг бэхжүүлж, загвар хулгайлагдахаас сэргийл.

Эдгээр алхмыг аль болох үр дүнтэй болгохын тулд компаниуд АНУ-ын засгийн газартай хамтран ажиллах ёстой. Хурдаа сааруулахад энэ бүгд зайлшгүй хэрэгтэй гэдгийг ямагт ойлгож ирсэн учраас Антропик эдгээр бүх арга хэмжээг тууштай дэмжиж ирсэн юм.

Миний бодлоор хэрэв бид эдгээр арга хэмжээг сайн хэрэгжүүлбэл Хятадын дэвшлийг хангалттай удаашруулж, ирэх 3-5 жилд Америкийн тэргүүлэх байр суурийг мэдэгдэхүйц тэлэх болно. Яг энэ хугацаанд хиймэл оюун геополитикийн хувьд хамгийн чухал болно.

Эдгээр арга хэмжээ Хятадтай хамтрахад улам хэцүү болгоно гэж зарим хүн бодож байж магадгүй. Миний бодлоор бол харин ч эсрэгээрээ, эдгээр арга хэмжээ ардчилсан улсуудын хөшүүргийг нэмэгдүүлж, ирээдүйд тохиролцоонд хүрэх магадлалыг өсгөнө.

Дэлхийн хэмжээнд хурдаа сааруулах нь

Ардчилсан орнууд дотроо хурдаа сааруулахтай зэрэгцээд бид тэргүүн эгнээний хурдыг дэлхийн хэмжээнд сааруулахыг зорих ёстой. Гэхдээ үүнд хүрэх нь хавьгүй бэрх. Дэлхийн хэмжээнд хурдаа сааруулна гэдэг нь Хятадтай хамтрахыг шаардана. Хиймэл оюуны хамгийн дэвшилтэт чадвартай дарангуйлагч улс бол Хятад. Бид гэнэн байж болохгүй. Геополитикийн эрсдэл дэндүү өндөр учраас, ялангуяа эхэн үедээ, хүрч болох тохиролцоо хатуу хязгаартай байх магадлалтай. Хэрэв бид Хятад ч мөн адил хийнэ гэж итгээд хиймэл оюуны чадвараа эрс хязгаарлатал Хятад тохиролцооноос няцаж, улмаар хиймэл оюуны жинхэнэ хүчээ гаргавал тэд геополитикийн ноёрхолд хүрч болзошгүй. Тиймээс аливаа тохиролцоо гянтболд шиг бат баталгаажуулалттай байх, эсвэл няцалт нь цэргийн хувьд оршин тогтнолд аюул учруулахааргүй хязгаарлагдмал байх ёстой. Зөвхөн АНУ төдийгүй Хятад ч мөн ийм эргэлзээ, түгшүүртэй байгаа болов уу гэсэн таамаг надад бий. Ойрын хугацаанд дэлхийн хэмжээнд хиймэл оюуны хурдыг сааруулах асуудалд АНУ болон холбоотнуудын тэргүүлэх байр суурийг хамгаалах байдлаар хандах хэрэгтэй.

Тохиролцооны хэд хэдэн түвшин бий. Заримыг нь би бүрэн боломжтой гэж үздэг бөгөөд өмнө нь ч санал болгож байсан. Заримд нь би маш их эргэлздэг ч оролдоод үзэх нь зүйтэй. Тэдгээрийг хүндийн дарааллаар нь жагсаавал:

• 1 дүгээр түвшин: Хиймэл оюуны илт аюултай хэрэглээ, тухайлбал биологийн зэвсэг үйлдвэрлэхэд ашиглах, эсвэл хэрэглэгчдэд тэгэхийг зөвшөөрөхийг хориглосон тохиролцоо. Био терроризмын халдлага АНУ гэлтгүй АНУ-ын өрсөлдөгчдөд ч муугаар тусах учраас энд тохиролцоонд хүрэх боломжтой байх.

• 2 дугаар түвшин: Хоёр тал загвараа гаргахаасаа өмнө кибер аюулгүй байдал, биологи, нийцүүлэлт зэрэг чиглэлд хурц эрсдэл байгаа эсэхийг шалгах тохиролцоо. Дээр дурдсанчлан үүнийг дэлхийн стандартын байгууллагаар дамжуулан хийж болно. Ийм байгууллага байгуулах нь боломжтой гэж боддог. Гэхдээ тэрхүү байгууллагад бодитой эрх мэдэл өгөх нь сорилт байх бөгөөд хоёр тал шалгуулалгүй, нууцаар нэвтрүүлж мэдэх (жишээ нь цэргийн зориулалттай) өөр загваргүй гэдгийг баталгаажуулах нь хүндхэн сорилт байх болно.

• 3 дугаар түвшин: Өөрийгөө давтан сайжруулах хурдад тавих нэг төрлийн «хурдны хязгаар». Хиймэл оюуны загвар өөрөө өөрийгөө сайжруулсаар өсөлтийн хурд нь ухаан балартмаар түвшинд очиж мэднэ. Хурдыг «туйлын хурдан»-аас «зөвхөн нэлээд хурдан» болгож бууруулах нь стратегийн давуу талыг харьцангуй бага золиослох боловч аюулгүй байдлыг ихээхэн сайжруулж мэднэ. Үүнийг SALT гэрээтэй зүйрлэж болно. Пуужингийн тоог хязгаарлах нь сүйрлийн эрсдэлийг бууруулахын зэрэгцээ улс бүрийн сэргийлэн зогсоох хүчийг хадгалж үлдээсэн юм. Ийм тохиролцоонд хүрэхэд бэрх ч яг л боломжийн ирмэг дээр байгаа гэж би боддог.

• 4 дүгээр түвшин: Засгийн газрууд хиймэл оюуны хөгжлийн нийт хурдыг мэдэгдэхүйц хязгаарлахаар тохиролцох эсвэл бүр «түр зогсоолт»-д ч санал нэгдэж болно. Үүнийг хэлэлцэх санааг би дэмждэг ч ойрын хугацаанд үнэхээр биелэхгүй л байх. Хяналтаас мултарч ийм тохиролцооноос няцах нь дэлхийн хүчний тэнцвэрийг үндсээр нь өөрчилж мэдэх тул энэ тохиролцоонд шаардах итгэлцлийн түвшин маш өндөр байх хэрэгтэй болно.

Хятадтай хүрч чадсан аливаа хамтын ажиллагаа ардчилсан орнууд дотроо тэргүүн эгнээний хурдаа сааруулах боломжийг олгоно. Бид мэдээж өндөр түвшний тохиролцоонд зорих ёстой ч анхан түвшин нь хамаагүй бодитой, биелэх магадлал өндөр гэдгийг ч бодох хэрэгтэй.

Эцэст нь тэмдэглэхэд, албан ёсны тохиролцоонд хүрч чадаагүй ч албан бус хэм хэмжээг өөрчлөх нь ч үр дүнтэй. Өөрийгөө давтан сайжруулах аргын тухай, загварын нийцгүй байдлын тухай мэдээллээ хуваалцах нь хайхрамжгүй байх бид бүгдийн ашиг сонирхолд нийцэхгүй гэдгийг ойлгуулахад тус болно.

Товч дүгнэлт

Хиймэл оюун хүний амьдралын чанарыг асар их сайжруулж чадна гэдэгт би итгэсээр байна. Тэр ашиг тусыг хүртэх хүсэл минь алга болоогүй. Гэвч технологийг зөв байдлаар бүтээж байж л ашиг тусыг нь хүртэнэ. Олж авсан цагаа бид сайн ашиглаж, ер бусын нямбай хандах хэрэгтэй. Хурдаа сааруулснаар бид тайлбарлах чадварын шинжлэх ухааныг ахиулж, тэргүүн эгнээний компаниудын үйл ажиллагааны аюулгүй байдал, нягт нямбай байдлыг сайжруулж, нийцүүлэлтэд нь хамаагүй итгэлтэй байж чадах загвар бүтээж чадна. Тэргүүн эгнээг аюулгүй хурдаар урагшлуулах миний санал болгож буй эдгээр арга хэмжээ амар хялбар байхгүй. Гэвч оролдоод үзэх нь хүн төрөлхтний өмнө хүлээсэн бидний үүрэг юм.