OpenAI шинэ үеийн "GPT-6 Astra" загвараа танилцууллаа: 1M контекст, автономит "компьютер оператор" ба аюулгүй байдлын "Critical" босго
OpenAI компани хиймэл оюун ухааны дараагийн томоохон үе шат болох GPT-6 Astra флагшип загвараа албан ёсоор танилцууллаа. Энэхүү шинэ загвар нь программ хангамж хөгжүүлэлт, кибер аюулгүй байдал, шинжлэх ухааны тооцоолол болон системийн автоматжуулалтын салбарт урьд өмнө байгаагүй үсрэлт авчирч байна. Хамгийн чухал нь, GPT-6 Astra нь зүгээр нэг текст үүсгэгч LLM биш, компьютерын үйлдлийн систем, терминал, хэрэгслүүдийг бие даан удирдаж ажиллах бүрэн хэмжээний "Computer Operator" агент болж хувирчээ.
Чатын цонхноос үйлдлийн систем рүү: 1.05M контекст цонх
Хөгжүүлэгчдийн хувьд хамгийн том техникийн өөрчлөлт нь контекст болон гаралтын хэмжээ юм. GPT-6 Astra нь 1,050,000 токены контекст цонх болон нэг дор 128,000 хүртэлх токены гаралт (max output tokens) дэмжих чадвартай ирж байна. Энэ нь олон мянган файл бүхий монолит код бааз, архитектурын схем, бүхэл бүтэн төслийн Git түүхийг нэг дор санах ойд нь ачаалж дүн шинжилгээ хийх боломжийг олгож байгаа юм.
Astra-г энгийн загваруудаас ялгаж буй гол зүйл нь үйлдлийн системтэй шууд харьцах чадвар юм. GUI дэлгэцийг харах, хөтөч ашиглах, код засварлах орчинд ажиллах, CLI дээр комманд ажиллуулах, тестийн үр дүнг шалгаад алдаа гарвал өөрөө засаж давтах үйлдлүүдийг хүний шууд чиглүүлэггүйгээр гүйцэтгэж чаддаг. Компьютер ашиглалтын бодит даалгавруудыг хэмждэг OSWorld 2.0 бенчмарк дээр уг загвар 72.6% оноо авсан бөгөөд нэг даалгаврыг дунджаар 40 минутад гүйцэтгэсэн нь өмнөх үеийн GPT-5.6 Sol загварын 75 минутын үзүүлэлтийг бараг 2 дахин хурдасгасан байна.
Recurrent Depth Reasoning ба бенчмаркийн амжилтууд
OpenAI энэ загварт шинэ төрлийн Recurrent Depth Reasoning архитектурыг нэвтрүүлсэн бөгөөд хөгжүүлэгчид API-аар дамжуулан бодолтын гүнийг 5 түвшинд (low, medium, high, xhigh, max) тохируулах боломжтой болсон.
Хөгжүүлэлт болон тооцооллын бенчмаркууд дээрх үзүүлэлтүүд:
- ExploitBench: 100% (Бүх туршилтын даалгаврыг амжилттай гүйцэтгэсэн)
- FrontierMath Tier 4: 97.6% (Өндөр түвшний математикийн бодлогуудыг шийдсэн)
- ARC-AGI-3: 99.9% (Reasoning төлөвийг алхам хооронд хадгалдаг системээр туршихад хүний анхан шатны түвшинг давсан)
- Terminal-Bench Science 0.1: 64.6% амжилт үзүүлж, Claude Fable 5.1 (52.6%)-ээс API-ийн зардлын хувьд 31% хямд байдлаар илүү гарсан байна.
Эдгээр оноо нь Astra зөвхөн функц кодчилоод зогсохгүй, төслийн бүтэн архитектур, өгөгдлийн сангийн шилжүүлэг (migration), CI/CD пайплайн болон асуудлын логик үндсийг бие даан төлөвлөж чаддагийг харуулж байна.
Түүхэнд анх удаа "Critical" зэрэглэлд хүрсэн нь
GPT-6 Astra-ийн хамгийн их анхаарал татсан бөгөөд дэлхий нийтийг сэртхийлгэсэн мэдээ нь аюулгүй байдлын үнэлгээ байлаа. OpenAI өөрсдийн Preparedness Framework-ийн дагуу кибер аюулгүй байдлын чиглэлээр түүхэнд анх удаа "Critical" түвшний эрсдэлтэй гэж албан ёсоор зарлав.
Энэ зэрэглэл нь юу гэсэн үг вэ гэвэл: уг модель нь хүний нэг бүрчилсэн удирдамж, тусламжгүйгээр хамгаалалт сайтай системүүдээс урьд өмнө мэдэгдээгүй аюулгүй байдлын цоорхойг өөрөө илрүүлж, ажиллах чадвартай эксплойт (exploit chain) угсрах чадвартай болсон гэсэн үг юм.
OpenAI-ийн систем карт (System Card)-д дурдсанаар, дотоод туршилтын үеэр Astra нь:
- Системд нэвтрэх туршилтаар урьд өмнө мэдэгдээгүй хоёр шинэ Zero-Day эмзэг байдлыг бие даан илрүүлсэн.
- Хязгаарлагдмал эрхтэй энгийн хэрэглэгчээс системийн үндсэн эрх (root privilege escalation) рүү шилжих халдлагын дарааллыг бие даан гүйцэтгэсэн.
- Вэб хөтчийн Sandbox-оос хальж, эх машин (host) дээр комманд ажиллуулах бүрэн гинжин халдлагыг амжилттай туршсан байна.
Эдгээр чадвар нь халдагчдын гарт орвол асар их эрсдэл дагуулах тул OpenAI загварын кибер даалгавар биелүүлэх чадварт хатуу guardrail болон хамгаалалтын систем суулгаж, засгийн газрын түншүүд болон нэр хүнд бүхий хамгаалалтын байгууллагуудад урьдчилан хязгаарлагдмал горимоор шалгуулжээ.
Хөгжүүлэгчид болон инженерүүдэд энэ нь юуг илтгэж байна вэ?
Энэхүү үйл явдал нь бидний өдөр тутмын хөгжүүлэлтийн практикт дараах шууд нөлөөг үзүүлнэ:
- Кодчилолоос Агент Удирдлага руу (Managing Agents): Бид нэг мөр код бичүүлж хуулж тавьдаг үеэс нэгэнт хальж байна. Хөгжүүлэгчийн үүрэг нь өндөр түвшний архитектурын шаардлага тодорхойлох, агентын гаргасан өөрчлөлтүүдийг CI/CD болон автомат тестийн түвшинд баталгаажуулах менежер рүү шилжиж байна.
- Defensive Security-ийн шинэ эрин: Загварын Exploit хөгжүүлэх чадвар нь нөгөө талдаа хамгаалагчдад асар том давуу тал болно. SecOps болон хөгжүүлэлтийн багууд Astra-г ашиглан өөрсдийн кодоос уламжлалт статик шинжилгээний хэрэгслүүдийн (SAST/DAST) олж чаддаггүй далд logic bug, нийлмэл race condition болон zero-day цоорхойнуудыг бүтээгдэхүүн release хийхээс өмнө илрүүлэх боломжтой болж байна.
- Үнэ ба Интеграци: OpenAI API дээр
gpt-6-astraнэрээр бүртгэгдсэн бөгөөд оролтын 1 сая токен нь $10.00, гаралтын 1 сая токен нь $50.00 үнэтэйгээр гарчээ. Энэ нь нарийн төвөгтэй даалгаварт зориулагдсан өндөр үнэтэй ч, жижиг моделиудын чадахгүй олон хоногийн ажлыг хэдхэн минутад багцлан шийдэх боломжийг олгож байна.
GPT-6 Astra нь хиймэл оюун ухааны загварууд зөвхөн "хариулт хэлэгч" байхаа больж, үйлдлийн системийг бодитоор эрхшээж, хэрэгсэл удирддаг бие даасан системийн түвшинд бүрэн шилжсэнийг баталлаа.
Эх сурвалж: OpenAI Official Announcement, OpenAI GPT-6 Astra System Card, Artificial Analysis Evaluation Report
Сэтгэгдэл
Ачаалж байна...