Мэдээ

AI Агентад "Root" эрх өгөх үе дуусав: USC-ийн инженерүүд агентын үйлдлийг бодит хугацаанд хянах "AEGIS" галт ханыг танилцууллаа

TOGTOKHTOGTOKH·2026 оны наймдугаар сарын 19·3 үзсэн·
AI Агентад "Root" эрх өгөх үе дуусав: USC-ийн инженерүүд агентын үйлдлийг бодит хугацаанд хянах "AEGIS" галт ханыг танилцууллаа

2026 онд AI агентууд зөвхөн чатлах биш, хөгжүүлэгчийн терминал дээр комманд ажиллуулах, өгөгдлийн санд query бичих, үүлэн дэд бүтцийг (Cloud infrastructure) удирдах зэрэг бодит үйлдлүүдийг бие даан гүйцэтгэдэг болоод байна. Гэвч агентад өгсөн эрх өргөжих тусам систем бүхэлдээ сүйрэх эрсдэл (catastrophic actions), өгөгдөл устгах, prompt injection халдлагад өртөх аюул эрс нэмэгдсэн.

Өмнөд Калифорнийн Их Сургуулийн (USC) Viterbi Инженерийн Сургуулийн FORTIS Lab-аас AI агентын үйлдэл бүрийг бодит цагт шүүн хянаж, эрсдэлтэй үйлдлийг гүйцэтгэхээс нь өмнө блоклодог AEGIS нээлттэй эхийн төсөл болон 3 шатлалт аудитын архитектурыг албан ёсоор танилцууллаа.


AI Агентын асуудал: "Hallucination" одоо зүгээр л текст биш

Өмнө нь хэлний загвар (LLM) буруу мэдээлэл үүсгэхэд хэрэглэгч түүнийг уншаад засах боломжтой байсан. Харин бие даасан Agentic системүүдийн эринд загвар буруу шийдвэр гаргах нь:

  • Буруу фолдер эсвэл үйлдвэрлэлийн (production) өгөгдлийн санг бүхэлд нь устгах (DROP TABLE, rm -rf),
  • Хэрэглэгчийн эмзэг мэдээлэл, API түлхүүрийг гаднын сервер рүү зөвшөөрөлгүй илгээх,
  • MCP (Model Context Protocol) болон бусад Tool-call холболтоор дамжин сүлжээний зөвшөөрөгдөөгүй цэгүүдэд хандах зэрэг бодит хохирол дагуулж байна.

USC-ийн профессор Юэ Жао (Yue Zhao)-гоор ахлуулсан багийн онцолсноор: "Агентад системийн түлхүүрийг атгуулахдаа бид ямар ч хяналтын механизмгүйгээр сохор итгэж байсан. Одоо агентыг ажиллахаас нь өмнө шалгадаг, ажиллаж байх хооронд нь блоколдог, ажиллаж дууссаны дараа криптограф түвшинд тайлагнадаг хамгаалалт зайлшгүй шаардлагатай боллоо."


3 шатлалт хамгаалалтын бүтэц: AEGIS хэрхэн ажилладаг вэ?

AEGIS (AI Agent Firewall) нь AI загвар болон үйлдлийн систем/хэрэгслүүдийн (Tools & APIs) хооронд Proxy / Middleware байдлаар байршина. Энэ нь ямар нэгэн код өөрчлөх шаардлагагүйгээр (Zero code changes) шууд залгагдах боломжтой бөгөөд дараах гурван түвшинд ажилладаг:

1. Pre-execution Verification (Үйлдлийн өмнөх шүүлтүүр)

Агент тодорхой нэгэн Tool дуудах (tool_call) команд өгөх үед AEGIS уг үйлдлийг саатуулан авч, урьдчилан тодорхойлсон аюулгүй байдлын бодлоготой (Policy-as-Code) нийцэж буйг шалгана. Хэрэв агент хориглосон скрипт эсвэл эмзэг файл руу хандах гэж байвал уг командыг гүйцэтгэлгүйгээр шууд тасална.

2. Runtime Guardrails & Human-in-the-Loop (Бодит хугацааны саатуулагч)

Хэрэв тухайн үйлдэл эргэлзээтэй эсвэл өндөр эрсдэлтэй гэж үнэлэгдвэл (жишээ нь: төлбөр гүйлгээ хийх, том хэмжээний файл устгах, git push force хийх) AEGIS уг үйлдлийг автоматаар түр царцааж, хүний баталгаажуулалтыг (Human Approval Flow) нэхнэ. Хөгжүүлэгч эсвэл админ зөвшөөрсөн тохиолдолд л үйлдэл цааш үргэлжилнэ.

3. Tamper-Evident Audit Trail (Криптограф аудитын бүртгэл)

Агент ямар шалтгаанаар, ямар контекст уншиж байгаад уг шийдвэрийг гаргасныг алхам бүрээр нь хөдөлшгүй баримтжуулна. Энэхүү бүртгэл нь өөрчлөх боломжгүй (tamper-evident) хэлбэрээр хадгалагддаг тул ямар нэг асуудал гарсны дараа “Post-mortem” шинжилгээ хийж, алдааны шалтгааныг 100% илрүүлэх боломжийг олгодог.


Хөгжүүлэгчдэд ямар ашиг тустай вэ?

  1. Docker/Container түвшнээс ч нарийн хяналт: Уламжлалт аргаар контейнерын эрхийг хязгаарлах нь агентын уян хатан байдлыг алдагдуулдаг байсан бол AEGIS нь үйлдлийн семантик утгыг ойлгож шийдвэр гаргадаг.
  2. MCP болон Агент фрэймворкуудтай нийцтэй: LangChain, CrewAI, AutoGen, Claude Code болон саяхан өргөн тархаж буй OpenCode төслүүдэд шууд залгагдаж ажиллана.
  3. Хууль, стандартын нийцэл (Compliance): Дэлхий даяар AI-ийн эрсдэлийг хянах дүрэм журмууд (EU AI Act гэх мэт) чангарч буй энэ үед компаниуд AI системүүддээ аудитын хяналтын давхарга заавал нэвтрүүлэх шаардлагатай болж байгаа бөгөөд уг төсөл үүний бэлэн шийдэл болж байна.

Дүгнэлт: Агентын эрин үеийн зайлшгүй дэд бүтэц

Бид AI-г зөвхөн код бичүүлдэг байсан шатнаас ажлын байран дээр бүрэн автомат даалгавар гүйцэтгүүлдэг шатанд шилжиж байна. Гэвч хангалттай хамгаалалтын давхаргагүй агентыг үйлдвэрлэлийн орчинд ашиглах нь хакеруудад системээ бүрэн нээж өгч буйгаас ялгаагүй юм.

USC FORTIS лабораторийн танилцуулсан AEGIS болон агентын аудитын хэрэгслүүд нь хөгжүүлэгчдэд AI агентуудаа бүрэн хяналтандаа байлгаж, найдвартай ажиллуулах чухал суурь болж өгч байна.


Эх сурвалж: USC Viterbi School of Engineering (USC-FORTIS Lab) — Giving AI Agents the Keys? USC Engineers Develop Tools to Audit and Monitor AI Agents (August 19, 2026).

Сэтгэгдэл

Ачаалж байна...