Мэдээ

Alibaba 2.4 триллион параметртэй Qwen3.8-Max загвараа танилцууллаа: 16 өдөр бие даан код бичдэг AI ба Open-Source шинэ эрин

TOGTOKHTOGTOKH·2026 оны наймдугаар сарын 10·4 үзсэн·
Alibaba 2.4 триллион параметртэй Qwen3.8-Max загвараа танилцууллаа: 16 өдөр бие даан код бичдэг AI ба Open-Source шинэ эрин

Хөгжүүлэлтийн салбарт шинэ стандарт тогтов

Сүүлийн жилүүдэд AI кодинг туслахууд (AI Coding Assistants) богино хэмжээний функц бичих, алдаа засах, рефакторинг хийх тал дээр асар хурдацтай хөгжиж байгаа билээ. Гэвч хөгжүүлэгчдийн хувьд тулгардаг хамгийн том бэрхшээл бол Long-Horizon Tasks буюу олон алхамтай, цогц төслийг эхнээс нь дуустал бие даан гүйцэтгэх чадвар байв.

Тэгвэл Азийн технологийн гигант Alibaba компани өөрийн хамгийн сүүлийн үеийн флагман AI загвар болох Qwen3.8-Max-ийг албан ёсоор танилцууллаа. Уг загвар нь AI хөгжүүлэлтийн салбарт хоёр том эргэлтийг нэгэн хамт авчирч байна:

  1. 16 өдрийн турш хүний оролцоогүйгээр бие даан код бичиж, төсөл хөгжүүлэх чадвар.
  2. Албан ёсны флагман "Max" ангиллын загварын жинг (Open-Weight) олон нийтэд нээлттэй олгох шийдвэр.

Энэхүү алхам нь OpenAI болон Anthropic зэрэг хаалттай (proprietary) экосистем давамгайлсан салбарт нээлттэй эх сурвалжийн (open-source) хүчийг дахин нэг шатаар ахиулж байна.


Qwen3.8-Max-ийн техникийн үзүүлэлт ба архитектур

Qwen3.8-Max нь зөвхөн хэмжээний хувьд аварга том биш, архитектурын хувьд өндөр бүтээмжтэйгээр зохион байгуулагджээ.

  • 2.4 триллион параметр (Sparse MoE): Загвар нь нийт 2.4 триллион параметр бүхий Mixture-of-Experts (MoE) бүтэцтэй. Гэсэн хэдий ч инференс (inference) ажиллагааны үед нэг дор ердөө 95 тэрбум (95B) параметрийг л идэвхжүүлдэг. Энэ нь тооцооллын зардлыг багасгаж, хариу өгөх хурдыг мэдэгдэхүйц нэмэгдүүлсэн байна.
  • 1 сая токен контекст цонх (Context Window): 1,000,000 токений багтаамжтай контекст цонх нь том хэмжээний код бааз (codebase), архитектурын баримт бичгүүд, микросервисийн логикуудыг нэг дор оруулж боловсруулах боломж олгоно.
  • Олон горимт ажиллагаа (Native Multimodal): Текстээс гадна зураг болон видеог шууд хүлээн авч, UI/UX дизайн болон системийн диаграмд шинжилгээ хийх чадвартай.

16 өдрийн автономит туршилт: AI өөрөө төслийг удирдсан нь

Qwen3.8-Max-ийн хамгийн онцлох амжилт бол Long-Horizon Autonomous Coding буюу урт хугацааны бие даасан хөгжүүлэлтийн туршилт юм.

Alibaba-ийн инженерүүдийн хийсэн дотоод туршилтаар загварт хоосон репозитори (empty repository) өгч, "oh-my-cli" нэртэй бие даан хөгждөг агентийн фрэймворк хийх даалгавар өгчээ. Уг туршилт 16 өдрийн турш тасралтгүй, хүний ямар ч оролцоогүйгээр үргэлжилсэн байна.

Энэ хугацаанд Qwen3.8-Max загвар нь:

  • Feedback Loop үүсгэсэн: Хэрэглэгчийн санал хүсэлт болон өөрийн авто-тестийн үр дүнг бүртгэж, автоматаар Issue үүсгэн өөртөө даалгавар хуваарилсан.
  • Код бичиж, Merge хийсэн: Шаардлагатай кодыг бичиж, коммит (commit) хийн, PR (Pull Request) үүсгэж байв.
  • Автомат туршилт ажиллуулсан: Unit test, End-to-End test болон Desktop lifecycle test-үүдийг ажиллуулж, үүссэн алдаа (bug)-гаа өөрөө оношлон зассан.

Туршилтын төгсгөлд репозиторид 265 Commit, 127 PR, 151 шийдвэрлэсэн Issue цугларсан бөгөөд бүрэн ажиллагаатай, тестийн бүрхэвч сайтай систем бэлэн болсон байв.


Бенчмарк амжилтууд: Фронтир загваруудтай өРСӨЛДСӨН нь

Alibaba-ийн нийтэлсэн бенчмарк туршилтуудаас харахад Qwen3.8-Max нь дэлхийн шилдэг хаалттай AI загваруудтай шууд өРСӨЛДӨЖ байна:

  • OSWorld-Verified: 86.1 оноо авч, GPT-5.6 Sol Max (83.2) болон Claude Fable 5 (85.0)-ийг зарим үзүүлэлтээр ардаа орхижээ.
  • PaperBench: Судалгааны ажлыг дахин давтах болон туршилт ажиллуулах даалгаварт 93.0 оноо авч өндөр амжилт үзүүлсэн.
  • Terminal-Bench 2.1 & SWE-bench Pro: Терминал дээр ажиллах ба бодит програм хангамжийн инженерийн даалгавруудыг гүйцэтгэх чадвараараа салбартаа тэргүүлэх түвшинд хүрсэн.

Open-Weight ба Үнийн бодлого: Хөгжүүлэгчдэд нээгдэж буй боломж

Ихэнх AI компаниуд өөрсдийн хамгийн хүчирхэг "Max" эсвэл "Ultra" ангиллын загваруудаа API-ийн цаана нууж, эх жинг нь хэзээ ч нийтэлдэггүй. Гэвч Alibaba ирэх долоо хоногт Qwen3.8-Max-ийн жинг Hugging Face болон ModelScope дээр нээлттэй (open-weight) нийтлэхээ зарлалаа. Энэ дагаж бага хэмжээний Qwen3.8-27B загвар мөн гарах юм.

Энэ нь хөгжүүлэгчид болон байгууллагуудад дараах боломжуудыг олгоно:

  1. Self-Hosting & Data Privacy: Байгууллагууд өөрсдийн локал эсвэл private cloud сервер дээр фронтир түвшний AI загварыг суулган, нууцлалтайгаар ашиглах боломжтой болно.
  2. Хямд API зардал: Alibaba Cloud Model Studio-ийн API-аар ашиглахад 1 сая input токен тутамд $2, output токен тутамд $6 үнэтэй байгаа нь өөр ижил түвшний загваруудаас дахин дахин хямд юм.

Дүгнэлт: Хөгжүүлэгчийн ирээдүйн роль хэрхэн өөрчлөгдөх вэ?

Qwen3.8-Max-ийн танилцуулга бидэнд нэг зүйлийг маш тодорхой харуулж байна: AI кодинг туслахууд одоо зөвхөн синтакс гүйцээгч (autocomplete) түвшинд байхаа больсон. Тэд олон өдрийн турш тасралтгүй ажиллаж, систем архитектур боловсруулах, тест ажиллуулах, төслийн менежмент хийх Агентик хөгжүүлэлтийн (Agentic Software Engineering) шатанд шилжлээ.

Хөгжүүлэгчдийн хувьд код мөр мөрөөр нь гардан бичихээс илүүтэйгээр системийн дизайн, архитектурын шийдвэр, AI агентуудын feedback loop болон чанарын хяналтыг (validation) удирдах чиглэлд мэргэших шаардлага тулгарч байна.

Эх сурвалж: Alibaba Cloud Blog & DataCamp Research

Сэтгэгдэл

Ачаалж байна...