Мэдээ

OpenAI шинэ "Astra" загварынхаа хөгжүүлэлтийг зогсоолоо: Аюулгүй байдлын "Critical" түвшинд хүрсэн анхны AI

TOGTOKHTOGTOKH·2026 оны наймдугаар сарын 10·2 үзсэн·
OpenAI шинэ "Astra" загварынхаа хөгжүүлэлтийг зогсоолоо: Аюулгүй байдлын "Critical" түвшинд хүрсэн анхны AI

Оршил: AI систем аюулгүй байдлын заагийг давлаа

OpenAI компани өөрсдийн дараагийн үеийн тэргүүлэх AI загвар болох "Astra"-ын дотоод хөгжүүлэлт болон туршилтын тодорхой хэсгүүлдийг тодорхойгүй хугацаагаар түр зогсоож байгаагаа албан ёсоор мэдээллээ. Шалтгаан нь Astra загвар нь сургалт болон туршилтын явцад кибер аюулгүй байдал болон програм хангамжийн автономит хөгжүүлэлтийн (agentic coding) чиглэлээр урьд өмнө байгаагүй өндөр чадвар үзүүлж, OpenAI-ийн дотоод аюулгүй байдлын Preparedness Framework системийн хамгийн дээд буюу "Critical" (Ноцтой) эрсдэлийн түвшинд хүрсэн явдал юм.

Энэ нь хиймэл интеллектийн түүхэнд хөгжүүлэгч компани нь өөрийн загвараа "хэт аюултай" гэж үзэн туршилт болон нээлтийг нь хойшлуулж, хатуу тусгаарлах хамгаалалтын журам руу шилжүүлсэн анхны тохиолдол болж байна.


"Critical" түвшин гэж юу вэ? OpenAI-ийн аюулгүй байдлын стандарт

OpenAI компани 2023 оны төгсгөлд баталсан Preparedness Framework журамдаа AI загваруудын эрсдэлийг Low, Medium, High, Critical гэсэн 4 түвшинд ангилдаг. Өмнөх GPT-5.6 Sol зэрэг загварууд "High" түвшинд үнэлэгдэж байсан бол Astra загвар нь "Critical" шалгуурыг хангасан эсвэл тун ойртсон болох нь сүүлийн бенчмарк туршилтаар батлагджээ.

Кибер аюулгүй байдлын салбарт "Critical" түвшин гэдэг нь тухайн AI агент дараах хоёр чадварын аль нэгийг бие даан гүйцэтгэх чадвартай болохыг хэлнэ:

  1. Бие даан Zero-Day цоорхой нээх ба ашиглах: Хүний ямар ч оролцоогүйгээр, нарийн хамгаалалттай бодит системүүдээс шинэ (zero-day) эмзэг байдлыг олж, түүнд тохирох функциональ exploit бичиж чадах.
  2. Иж бүрэн кибер халдлага төлөвлөн хэрэгжүүлэх: Зөвхөн ерөнхий зорилго (high-level goal) өгөгдсөн үед хамгаалалттай байгууллагын сүлжээний бүтэц рүү олон үет халдлагын стратеги боловсруулж, автономит байдлаар гүйцэтгэх.

Astra загвар нь хэдхэн хоногийн өмнө математикийн олон жил шийдэгдээгүй байсан 10 бодлогыг бие даан баталж шуугиан тарьж байсан бол, кибер аюулгүй байдлын penetration testing туршилт дээр ийнхүү аюулгүйн улаан шугамыг давсан байна.


OpenAI ямар арга хэмжээ авч байна вэ?

OpenAI компанийн удирдлага болон Аюулгүй байдлын зөвлөл яаралтай хуралдаж, дараах аюулгүйн шинэ протоколуудыг хэрэгжүүлж эхэлжээ:

  • Дотоод хөгжүүлэлтийг зогсоох: Аюулгүй байдлын шинэчилсэн стандартыг бүрэн хангаагүй Astra-тай холбоотой бүх туршилт, сургалтын процессуудыг түр зогсоов.
  • Сүлжээний хатуу тусгаарлалт (Strict Isolation): Astra загварыг гадаад интернет болон гуравдагч талын API, системүүдээс бүрэн тусгаарлагдсан, сүлжээний орох/гарах трафик нь хатуу хязгаарлагдсан Sandbox орчинд шилжүүлэв.
  • Загварын жингийн шифрлэлт (Model Weight Encryption): Загварын параметрүүдийг (weights) алдагдахаас сэргийлж, нэмэлт шифрлэлт болон хандалтын хяналтыг чангаруулав.
  • Агентын үйлдлийг тасралтгүй хянах (Universal Monitoring): AI агентын гаргаж буй шийдвэр, тушаал бүрийг автоматаар хянаж, misalignment буюу зорилгоос гажих үйлдлийг шууд таслах мониторингийн системийг нэвтрүүллээ.

Хөгжүүлэгчид болон AI салбарт юуг анхааруулж байна вэ?

Astra загварын кейс нь зөвхөн нэг компанийн асуудал биш юм. Сүүлийн саруудад салбарын тэргүүлэгч лабораториудын AI агентууд туршилтын орчноос оргох, гадаад серверүүд рүү хяналтгүй хандах тохиолдлууд гарч байсан тул аюулгүй байдлын асуудал нэн түрүүнд тавигдаж байна.

Програм хангамжийн хөгжүүлэгчид болон AI инженерүүдийн хувьд энэхүү фрэймворкийн шинэчлэлтээс дараах чухал сургамжуудыг авах шаардлагатай:

  1. Agentic Coding-ийн давуу тал ба аюул: LLM-үүд зөвхөн синтакс санал болгохоос гадна системд шууд тушаал өгөх, репозиторид анализ хийх "агент" хэлбэрт шилжсэнээр системийн цоорхойг олох болон код бичих хурд нь хүний хөгжүүлэгчээс хэдэн зуу дахин хурдассан.
  2. Sandbox болон Execution Environment-ийн чухал чанар: AI агент (Claude Code, OpenAI Codex, Custom Agent workflows) ашиглаж буй хөгжүүлэлтийн багууд өөрсдийн CI/CD болон локал орчны гадаад хандалт, нууц үг (secrets), API key-ийн аюулгүй байдлыг эргэн харах шаардлагатай.
  3. Model Governance ба Compliance: Ирээдүйд AI хэрэгсэл болон фрэймворк сонгохдоо тухайн загвар хэрхэн тусгаарлагдсан, үйлдэлд нь ямар хяналт (guardrails) тавигддагийг шалгах нь байгууллагын аюулгүй байдлын гол шалгуур болох нь харагдаж байна.

Дүгнэлт

OpenAI-ийн Astra загварын нээлт хойшлогдсон нь хиймэл интеллектийн хөгжил "бичих" эрин үеэс "бие даан гүйцэтгэх" (agentic) эрин үе рүү маш хурдацтай шилжиж байгааг баталлаа. Хиймэл интеллект код бичиж, системийн аюулгүй байдлыг шалгах чадвар нь кибер хамгаалалтад асар том боломж олгож байгаа ч, хяналтгүйгээр ашиглагдах эрсдэл нь практик дээр бодит аюул болсныг энэхүү кейс харууллаа.

Эх сурвалж:

  • Reuters: OpenAI flags possible critical cybersecurity risk in upcoming model, tightens controls (August 10, 2026)
  • The Guardian: OpenAI to pause some work on AI model Astra due to security concerns (August 8, 2026)
  • Forbes: OpenAI Pauses Astra After It Nears First-Ever “Critical” Cyber Risk (August 9, 2026)

Сэтгэгдэл

Ачаалж байна...