Claude Code "Auto Mode"-ийг анхдагч болголоо: Хөгжүүлэгчид аюултай тушаалын ердөө 13.6%-ийг л анзаардаг нь тогтоогдлоо
AI Кодчилол ба "Хүний Хариуцлага"-ын Томоохон Доройтол
Программ хөгжүүлэлтийн салбарт AI агентууд зөвхөн код санал болгохоос гадна терминал болон CLI (Command Line Interface) орчинд бие даан код ажиллуулж, файлуудыг өөрчлөн, боловсруулах процессуудыг гүйцэтгэдэг шинэ үе нэгэнт эхлээд байна. Гэвч энэ хурдацтай дэвшлийн хажуугаар хөгжүүлэгчдийн аюулгүй байдлын анхаарал буурах, аюултай тушаалуудыг анзааралгүй өнгөрөөх эрсдэл ноцтой асуудал болон хувирлаа.
Anthropic компаниас 2026 оны 8-р сарын 10-ны өдөр гаргасан албан ёсны мэдэгдлээр Claude Code хэрэгслийн "Auto Mode" (Автомат аюулгүй байдлын хяналтын горим)-ийг 8-р сарын 14-ний өдрөөс эхлэн Pro, Max, болон Team багцын бүх хэрэглэгчдийн хувьд анхдагч (default) горим болгохоор шийдвэрлэжээ.
Энэхүү шийдвэрийн цаана хөгжүүлэгчдийн өдөр тутмын нийтлэг зуршил болон тэдний явуулсан AI аюулгүй байдлын томоохон туршилтын цочирдом үр дүн оршиж байна.
1,053 Хөгжүүлэгч Дээр Хийсэн Баримт: Хүмүүс Ердөө 13.6%-ийг Анзаарчээ
Anthropic компани 1,053 туршлагатай, мэргэжлийн программ хөгжүүлэгчдийг оролцуулан хяналттай орчинд томоохон судалгаа явуулжээ. Судалгааны зорилго нь Claude Code-ийн ажиллуулж буй терминалын тушаалууд (CLI commands) болон файлын өөрчлөлтүүдэд хүн хэрхэн ажиглалт хийж, системийн аюулгүй байдалд заналхийлсэн үйлдлүүдийг бодитоор зогсоож чадаж байгааг хэмжих явдал байв.
Туршилтын үр дүн хөгжүүлэгчдийн нийгэмлэгийг гайхшруулсан юм:
- Хүний хяналт (Human Review): Мэргэжлийн туршлагатай хөгжүүлэгчид AI агент боловсруулж ажиллуулсан аюултай, буцааж болохгүй (destructive, irreversible) тушаалуудын ердөө 13.6%-ийг л бодитоор анзаарч, зогсоож чаджээ. Үлдсэн 86.4% аюултай тушаал нь хөгжүүлэгчийн зөвшөөрлөөр систем дээр шууд ажилласан байна.
- AI-ийн Auto Mode хяналт: Харин тусгайлан бэлтгэсэн AI ангилагч (classifier) систем аюултай тушаалуудын 89%-ийг бие даан тодорхойлж, ажиллахаас нь өмнө амжилттай блоклосон байна.
Хөгжүүлэгчдийн хувьд өдөр тутмын ажилдаа AI-ийн ажиллуулж буй олон зуун тушаалд зааварчилгаа бүрийн дараа "Yes" эсвэл "Enter" дарахаас өөр сонголтгүй мэт санагддаг. Үүнийг салбарынхан "Permission Fatigue" буюу зөвшөөрлийн зуршлын ядалралт гэж нэрлэж байна. Үүний уршгаар production датабааз устгах (rm -rf, DROP DATABASE), системийн эрхийг өөрчлөх, эсвэл сүлжээний гадаад орчин руу нууц түлхүүрүүд (API keys, credentials) алдагдах зэрэг ноцтой аюулыг хүмүүс дэлгэц дээрээ харсаар байж анзааралгүй өнгөрөөдөг нь нотлогджээ.
Auto Mode Яаж Ажилладаг Вэ? (Архитектур ба Механизм)
Шинээр анхдагч тохиргоо болж буй Auto Mode нь хөгжүүлэгч болон Claude Code-ийн дунд аюулгүй байдлын тусгай хамгаалалтын давхарга (Safety Classifier) болон ажилладаг. Энэ нь арын фон дээр маш хурдан ажилладаг тусгай AI загвар бөгөөд дараах логикоор процессыг удирддаг:
- Tool Call бүрийг шүүх: Claude Code терминал дээр ямар нэгэн CLI тушаал ажиллуулах эсвэл системд өөрчлөлт хийх хүсэлт (
tool call) гаргах бүрд уг тушаалыг замаас нь тосон авч, аюулгүй байдлын эрсдэлийн түвшнийг тодорхойлно. - Аюултай үйлдлийг блоклох: Системийн үндсэн тохиргоог эвдэх, локал орчноос гадагш зөвшөөрөгдөөгүй сүлжээний хүсэлт явуулах, эсвэл файлуудыг буцааж сэргээгдэхгүйгээр устгах тушаал ирвэл Auto Mode шууд блоклоно.
- Аюулгүй хувилбар хайх: Тушаал блоклогдмогц Claude Code-д илүү аюулгүй өөр хувилбар олох (жишээ нь, заавал
rootэрх шаардахгүйгээр ажиллуулах эсвэл--dry-runфлаг ашиглах) зааварчилгааг систем автоматаар өгнө. - Хүнд шилжүүлэх нөхцөл: Хэрэв Claude 3 удаа дараалан аюултай тушаал ажиллуулахыг оролдвол, эсвэл нэг сесс дээр 20 удаа блоклогдвол автоматаар зогсож, хөгжүүлэгчийн гаргасан тусгай зөвшөөрлийг шаардана.
Энэхүү арын AI ангилагч (classifier)-ийн ажиллагаанд шаардагдах нэмэлт compute зардлыг Anthropic компани өөрсдөө хариуцах бөгөөд хэрэглэгчдээс нэмэлт төлбөр авахгүй гэдгээ баталлаа.
Enterprise Орчин ба Хөгжүүлэгчдэд Үүсэх Өөрчлөлтүүд
Энэхүү шинэчлэл нь Pro, Max, Team багцын хэрэглэгчдэд шууд идэвхжих бол Enterprise болон API хэрэглэгчдийн хувьд арай өөр журмаар явна. Claude Enterprise, Claude API, Amazon Bedrock, Google Cloud, болон Microsoft Foundry платформ дээр энэхүү горим шууд албадан идэвхжихгүй бөгөөд байгууллагын IT болон Security администраторуудад туршиж үзэх, дотоод аудитын багтаа шалгах боломж олгох үүднээс ирэх сарын турш сонголттой (optional) байх юм.
Энэхүү үйл явдал нь программ хөгжүүлэлтийн салбарт хэд хэдэн чухал дохиог өгч байна:
- Хүний хяналтын тактик өөрчлөгдсөн: AI кодоо асар хурдан бичиж, секундэд олон арван тушаал өгч байгаа энэ үед хүн бүх кодын мөр, тушаал бүрийг гараар хянаж чадахгүй гэдэг нь тодорхой болов.
- AI-г AI-аар хянах шинэ стандарт: Зөвхөн код бичих биш, бичсэн кодоо аюулгүй орчинд ажиллуулах, турших, хянах процессыг AI агент болон тусгайлсан аюулгүй байдлын загварууд (safety classifiers) хамтран гүйцэтгэдэг архитектур салбарын стандарт болж байна.
- Эрсдэл бүрэн арилахгүй: AI ангилагч 89%-ийн аюултай тушаалыг барьж байгаа ч үлдсэн 11%-ийн эрсдэл байсаар байна. Тиймээс Sandbox орчин, Docker контейнер эсвэл тусгайлсан виртуаль орчинд AI агенттай ажиллах шаардлага хэвээр байна.
Хөгжүүлэгчдийн хувьд тушаал бүрийг харж "Yes" гэж дарахаас илүүтэй, AI агентад зориулсан хязгаарлалт, аюулгүй байдлын дүрмийг системд нь зөв тохируулж өгөх нь орчин үеийн инженерийн хамгийн чухал ур чадвар болж байна.
Эх сурвалж: HelpNet Security, Anthropic Official Newsroom
Сэтгэгдэл
Ачаалж байна...