Anthropic шинэ "Claude Fable 5.1" загвараа танилцууллаа: 1M контекст цонх, 128k гаралт ба 75%-ийн кэш хямдрал
Хиймэл оюуны салбарын өрсөлдөөн ширүүсэж буй энэ үед Anthropic компани программ хөгжүүлэгчид болон автоматжуулалтын инженерүүдэд зориулсан цоо шинэ тэргүүлэх загвар болох Claude Fable 5.1 болон түүний кибер аюулгүй байдлын хамгаалалттай ихэр загвар Mythos 5.1-ийг албан ёсоор цацлаа.
Энэхүү шинэчлэл нь зөвхөн ерөнхий чадварын үнэлгээ (benchmark)-ийг ахиулаад зогсохгүй, бодит программ хангамжийн архитектур, олон шатлалт кодинг агентуудын ажиллах зардал, санах ойн багтаамжид томоохон өөрчлөлт авчирч байна.
Монголын хөгжүүлэгчид болон технологийн багуудын заавал анхаарах ёстой гол өөрчлөлтүүдийг тоймлон хүргэж байна.
1. 1 сая токены контекст цонх ба 128k гаралтын лимит
Claude Fable 5.1 нь 1 сая токены контекст цонх (1M context window) болон нэг удаагийн хариултаар 128,000 хүртэлх токен гаргах чадвар (max output tokens)-тайгаар гарч ирлээ.
Өмнөх хувилбаруудад гаралтын токены хязгаар бага байснаас шалтгаалан том репозиторын бүтэц өөрчлөх, нэг дор бүхэл бүтэн модулийг шинэчлэн кодлох үед загвар хариултаа таслах тохиолдол гардаг байв. Харин 128k гаралтын багтаамжтай болсноор:
- Хэдэн арван файл бүхий бүтэн сан, API бүтэц эсвэл бичил үйлчилгээ (microservice)-г нэг хүсэлтээр бүрэн генерит хийх,
- Хэдэн зуун мянган мөр бүхий хуучны (legacy) кодын баазыг бүхэлд нь шинжилж, архитектурын шинэчлэлт бүхий төслийн кодыг нэг дор гаргах боломж бүрдэж байна.
2. Кодинг ба CursorBench 3.2: Өөрийгөө баталгаажуулах өндөр чадвар
Fable 5.1 загварын хамгийн том давуу тал нь кодын логик алдааг шалгах, өөрийн бичсэн кодыг давхар хянах чадвар (self-verification) эрс сайжирсан явдал юм.
Хөгжүүлэгчдийн дунд өргөн ашиглагддаг CursorBench 3.2 үнэлгээн дээр Fable 5.1 нь хамгийн дээд нарийвчлалын горимд (max effort) 73.4 хувийн амжилт үзүүлж, одоогоор зах зээл дээрх бүх загваруудыг тэргүүлж байна. Загварыг урьдчилан туршсан Datadog компанийн инженерийн баг уг загвар нь үйлдвэрлэлийн орчинд (production) үүссэн хамгийн ээдрээтэй системийн асуудлуудыг оношлох чадвараараа өмнөх хувилбаруудаас илт давуу байгааг дурдсан бол, SpaceXAI-ийн зүгээс агентын түвшинд төгсгөлөөс төгсгөл хүртэл бие даан код бичиж, тест хийн ажиллуулах чадвар өндөр байгааг онцолжээ.
3. Загварын сэтгэх горим: Always-on Adaptive Thinking
Шинэ загварт нэвтэрсэн хамгийн сонирхолтой функциональ нь Always-on Adaptive Thinking буюу дасан зохицох тасралтгүй сэтгэх горим юм.
Өмнө нь хөгжүүлэгчид загварт "алхам алхмаар бод" (chain-of-thought) гэж тусгайлан зааж өгөх шаардлагатай байсан бол Fable 5.1 нь даалгаврын ээдрээ төвөгтэй байдлыг өөрөө үнэлж, хэдий хэмжээний дотоод бодол (internal reasoning tokens) зарцуулахаа бие даан тооцоолдог болсон байна. Мөн API түвшинд хөгжүүлэгчдэд зориулсан дараах бета тохиргоонууд нэмэгджээ:
- Effort Controls: Бодолтод зарцуулах нөөцийн дээд хязгаарыг удирдах,
- Mid-conversation System Messages: Агентын ажиллагааны явцад контекстийг бүрэн цэвэрлэхгүйгээр дунд нь шинэ дүрэм, системийн зааварчилгаа нэмж оруулах.
Энэ нь ялангуяа Claude Code, Cursor, Windsurf зэрэг бие даасан хөгжүүлэлтийн агентууд олон алхамт ажиллагаа хийх үед замбараагүй байдалд орох (agent drift)-оос сэргийлэх том давуу тал болно.
4. Токены эдийн засаг: Prompt Cache Read 75% хямдрав
Хөгжүүлэгчдийн хувьд хамгийн таатай мэдээ бол үнийн бодлогын эрс шинэчлэлт байлаа. Anthropic загварынхаа Prompt Caching (кэшээс унших) зардлыг даруй 75 хувиар бууруулснаа зарлав.
Код бичих агент ажиллах үед төслийн файлын бүтэц, өмнөх файлууд, системийн зааврууд алхам тутамд дахин дахин дуудагддаг тул контекстийн оролт (input tokens) төсвийн хамгийн их хувийг эзэлдэг байв. Prompt Cache уншилтын үнэ 75% буурснаар томоохон систем хөгжүүлж буй багууд болон стартапуудын API зардал бодит байдал дээр 60-70 хувиар хэмнэгдэх тооцоо гарч байна.
5. Fable 5.1 ба Mythos 5.1: Ямар ялгаатай вэ?
Anthropic уг загварыг хоёр хувилбараар зарласан:
- Claude Fable 5.1: Бүх хөгжүүлэгч, байгууллагуудад API болон вэб интерфэйсээр шууд ашиглах боломжтой, аюулгүй байдлын нарийн шүүлтүүртэй олон нийтийн үндсэн хувилбар.
- Claude Mythos 5.1: Зөвхөн кибер аюулгүй байдлын судалгаа, сүлжээний хамгаалалтын компаниудад Project Glasswing түншлэлийн хүрээнд тусгай зөвшөөрөлтэйгөөр олгогдож буй хувилбар юм. Энэ хувилбар нь үйлдлийн систем, хөтөч болон суурь сангуудын zero-day цоорхойг хайж олох, хамгаалах тусгай чадвартай.
Хөгжүүлэгчдэд өгөх зөвлөмж
Хэрэв та өөрийн төсөлдөө Claude-ийн API-г ашигладаг бол дараах алхмуудыг хэрэгжүүлэхийг зөвлөж байна:
- API ID шинэчлэх: Төсөлдөө
claude-fable-5-1моделийн ID-г ашиглан туршиж эхлэх. - Prompt Caching-ийг заавал идэвхжүүлэх: 75%-ийн хямдралыг ашиглахын тулд системийн тохиргоо болон их хэмжээний кодын баазын хэсэгтээ cache breakpoint тохируулах.
- Effort түвшинг тохируулах: Энгийн кодын засвар дээр зардлыг багасгахын тулд
effort: lowэсвэлmedium, харин архитектурын хүнд refactoring хийх үедmaxтохиргоог ашиглах нь хурд болон зардлын тэнцвэрийг хангана.
Frontier түвшний AI загварууд зөвхөн "код бичдэг туслах"-аас бүхэл бүтэн системийн архитектурыг бие даан удирдаж, өөрийнхөө алдааг засдаг жинхэнэ хамтрагч болон хөгжсөөр байна.
Эх сурвалж: Anthropic Official Announcement, Claude Platform Release Notes, Local AI Zone.
Сэтгэгдэл
Ачаалж байна...