Мэдээ

OpenAI-ийн шинэ Astra загвар 10 жил шийдэгдээгүй бодлогуудыг Lean 4 кодоор баталж, GitHub дээр нийтэллээ

TOGTOKHTOGTOKH·2026 оны наймдугаар сарын 5·2 үзсэн·
OpenAI-ийн шинэ Astra загвар 10 жил шийдэгдээгүй бодлогуудыг Lean 4 кодоор баталж, GitHub дээр нийтэллээ

OpenAI компани албан ёсны маркетингийн томоохон арга хэмжээ хийлгүйгээр GitHub дээр ten-proofs нэртэй нээлттэй репозитори байршуулсан нь технологи болон программ хөгжүүлэлтийн салбарт том шуугиан тарилаа. Уг репозиторид онолын компьютерын ухаан болон математикийн салбарт 10 гаруй жил (зарим нь 27 жил) шийдэгдээгүй байсан 10 томоохон баталгааг Lean 4 хэл дээр бичсэн программчлалын кодын хамт нийтэлжээ.

Энэхүү амжилтыг OpenAI-ийн хараахан нийтэд дэлгээгүй байгаа шинэ үеийн тэргүүлэх "Astra" загварын дотоод хувилбар гүйцэтгэсэн байна. Гэхдээ энэ мэдээний хамгийн сонирхолтой хэсэг нь зөвхөн математикийн бодлого шийдсэнд биш, хиймэл интеллект "формал баталгаажуулалт" (formal verification) болон малти-агент архитектурыг хэрхэн програмчлалд ашиглаж болохыг практик дээр нотолсонд оршиж байгаа юм.

Lean 4 ба "Халюцинацигүй" хиймэл интеллект

Сүүлийн жилүүдэд LLM буюу том хэлний загварууд код бичихэд асар их ахиц гаргасан ч нэг том дутагдалтай байсан нь "уншихад зөв юм шиг боловч цаанаа алдаатай код эсвэл логик" (hallucination) бичих явдал байв.

Үүнийг шийдэх хамгийн найдвартай арга бол Lean 4 юм. Lean 4 нь функциональ програмчлалын хэл бөгөөд интерактив теорем батлагч (interactive theorem prover) орчин юм. Загвар зүгээр нэг байгалийн хэлээр текст бичихийн оронд баталгаагаа Lean 4 хэл дээр кодлон бичихэд Lean 4-ийн компилятор (verifier) тухайн кодын логик алхам бүрийг математик ёсоор 100% шалгадаг. Хэрэв компилятор код дээр ямар ч алдаа заахгүй задарвал уг баталгаа нь ямар ч халюцинацигүй, хөдөлшгүй үнэн гэдэг нь машин түвшинд нотлогдож байгаа юм.

OpenAI-ийн энэ удаагийн репозиторид байршуулсан 10 бодлогын код нь Lean 4 компилятораар ямар ч алдаагүй компилэгдэж байсан бөгөөд хөгжүүлэгчид өөрсдийн компьютер дээрээ клондон аваад шууд шалгах боломжтойгоороо онцлогтой.

Малти-агент систем ба ердөө 2,000 ам.долларын өртөг

Astra загвар нь зүгээр нэг ганц prompt-д хариулдаг чатбот биш юм. Уг систем нь олон цаг эсвэл хоногоор бие даан ажиллах чадвартай малти-агент (multi-agent orchestration) архитектуртай.

  1. Root Agent (Үндсэн агент): Том бодлогыг жижиг туслах дэд бодлогуудад зажлан хувааж, хязгаарлалтуудыг тодорхойлно.
  2. Sub-agents (Дэд агентууд): Дэд хэсэг бүр дээр параллелиар ажиллаж, Lean 4 кодын хэсгүүдийг бичиж, компилятораар тасралтгүй шалгана.
  3. Synthesis (Нэгтгэл): Үндсэн агент задарсан хэсгүүдийн үр дүнг цуглуулан, Lean 4 хэл дээрх бүрэн баталгааг нэгтгэн гаргадаг.

Дэлхийн шилдэг математикчдын 20-30 жил чадаагүй бодлогуудыг ийнхүү баталхад зарцуулсан тооцооллын өртөг (compute cost) нь API үнэлгээгээр ердөө 2,000 ам.доллар орчим болсон гэж OpenAI мэдэгдлээ. Энэ нь асар их нөөц шаардахгүйгээр ухаалаг агент хоорондын зохион байгуулалтаар нарийн төвөгтэй системүүдийг шийдэж болохыг харуулж байна.

Шийдэгдсэн бодлогуудын онцлох хэсгээс

GitHub дээр нийтлэгдсэн 249 хуудас судалгааны ажил ба Lean 4 сертификатууд дунд хэд хэдэн алдартай бодлогууд байна:

  • Non-sofic group: 1999 онд Михаил Громовын дэвшүүлсэн, "non-sofic group" байдаг эсэх тухай группийн онолын 27 жил шийдэгдээгүй нээлттэй асуултыг анх удаа код бичин байгуулж нотолсон.
  • Connes's Rigidity Conjecture: Фон Нейманы алгебрийн чиглэлээр Коннесын дэвшүүлсэн гипотезийг няцааж, эсрэг жишээг нотолсон.
  • Эрдёшийн бодлогууд: Алдартай математикч Пол Эрдёшийн цуглуулгаас Рамсей тооны тухай 183 дахь бодлого зэрэг 3 томоохон бодлогыг бүрэн шийдвэрлэсэн.

Программ хөгжүүлэгчдэд энэ мэдээ яагаад чухал вэ?

Энэхүү үйл явдал нь зөвхөн академик математикийн ялалт биш бөгөөд программ хөгжүүлэгчдийн ирээдүйн ажилд шууд хамааралтай хэд хэдэн чухал дохиог өгч байна:

  1. Формал баталгаажуулалт (Formal Verification) үндсэн урсгал болно: Блокчейн дэх Smart Contract, сансрын болон эмнэлгийн чухал системүүд, үйлдлийн системийн кернел (kernel) зэрэг баг (bug) гарах эрхгүй критикал системүүдэд AI нь Lean 4 эсвэл Coq зэрэг хэлээр 100% машин шалгасан аюулгүй код бичих боломж бүрдэж байна.
  2. "Vibe Coding"-оос Програмчлалын нарийн шалгалт руу: Код автоматаар үүсгэхээс илүүтэй үүссэн кодын логикийг компиляторын түвшинд математик нотолгоогоор шалгах нь хөгжүүлэгчийн хамгийн том чадвар болно.
  3. Асинхрон Агент Архитектур: Кодыг ганц секундэд үүсгэх биш, олон агентууд хоорондоо даалгавар дайж, хэдэн өдрөөр туршиж шалган төгс код боловсруулдаг шинэ workflow програм хөгжүүлэлтэд нэвтэрч байна.

Дүгнэлт

OpenAI-ийн Astra загварын энэхүү нээлт нь хиймэл интеллект зөвхөн интернетээс олдсон өгөгдлийг цээжлэн давтдаг бус, шинэ логик сэтгэлгээг машин шалгалттай кодоор дамжуулан бүтээж чаддаг болсныг нотоллоо. Программ хөгжүүлэгчдийн хувьд AI-ийг зөвхөн чатлах хэрэгсэл биш, харин алгоритм болон кодын маань логик зөв эсэхийг машин түвшинд баталгаажуулагч хүчирхэг "малти-агент" систем болгон ашиглах цаг хэдийнэ иржээ.

Эх сурвалж: OpenAI GitHub (openai/ten-proofs), Enterprise DNA, PacketNebula, Forbes Tech.

Сэтгэгдэл

Ачаалж байна...