Код бичилт ба "Hybrid Reasoning"-ийн шинэ эрин: Anthropic Claude 3.7 Sonnet болон Claude Code-ийг танилцууллаа
Хиймэл оюуны салбарт "Reasoning" буюу учир шалтгааныг алхам алхмаар тунгаан бодох загварууд хүчтэй түрэн орж ирсэн ч хөгжүүлэгчдэд нэгэн том сонголт тулгардаг байв: Хурдан боловч гүнзгий бодож чаддаггүй энгийн LLM ашиглах уу, эсвэл маш ухаалаг ч удаан, үнэтэй reasoning загвар ашиглах уу?
Anthropic компани энэ заагийг арилгаж, салбарын анхны хосолмол бүтэцтэй Claude 3.7 Sonnet загвар болон программистуудын өдөр тутмын ажлыг терминалаас бүрэн автоматжуулах Claude Code агент хэрэгслээ танилцууллаа.
1. Hybrid Reasoning: Нэг загвар, хоёр горим
Claude 3.7 Sonnet-ийн гол онцлог нь нэг загвар дотор энгийн хурдан горим (Standard Mode) болон уртасгасан задлан шинжлэх горимыг (Extended Thinking Mode) хамтад нь шингээсэнд оршино.
Хүний тархи энгийн асуултад шууд хариулж, хүнд даалгаварт гүн сууж боддогтой адил энэхүү загвар нь даалгаврын цар хүрээнээс хамааран ажиллах боломжтой:
- Standard Mode: Түргэн хариу шаардлагатай чат, баримт бичгийн асуулга, энгийн засварт зориулагдсан, Claude 3.5 Sonnet-оос сайжирсан хувилбар.
- Extended Thinking Mode: Алхамчилсан бодолтын процессийг хөгжүүлэгчид ил харуулж (chain-of-thought), хүнд логик болон архитектурын төвөгтэй шийдвэрүүдийг гаргана.
Хамгийн чухал нь, хөгжүүлэгчид API-аар дамжуулан загварт "Thinking Budget" буюу бодоход зориулах токены дээд хязгаарыг (128k хүртэл) нарийн зааж өгөх боломжтой болсон юм. Ингэснээр хурд, өртөг, чанарын балансыг код дотроо өөрсдөө 100% удирдах давуу тал бий болж байна.
2. Терминал дээрээс бүхнийг удирдах "Claude Code" CLI
Зөвхөн загвар зарлаад зогсохгүй, Anthropic хөгжүүлэгчдэд зориулсан Claude Code хэмээх судалгааны урьдчилсан хувилбар бүхий CLI (Command Line Interface) хэрэгслийг танилцууллаа.
Claude Code нь зүгээр нэг чатбот биш, таны кодын санг бүрэн ойлгож ажилладаг бие даасан агент юм:
- Бүхэл репозиторийг удирдах:
glob,grepзэрэг командуудыг ашиглан том төслийн файлууд дундаас хэрэгтэй хэсгийг өөрөө хайж олно. - Код засварлах ба Турших: Алдааг илрүүлж олон файлд зэрэг засвар оруулах, улмаар unit test болон build скриптүүдийг терминал дээр шууд ажиллуулж шалгана.
- Git урсгалыг автоматжуулах: Зассан өөрчлөлтүүддээ тайлбар хийж git commit үүсгэх, GitHub дээр Pull Request (PR) нээх хүртэлх бүх процессыг өөрөө гүйцэтгэх чадвартай.
# Claude Code-ийг суулгах ба ажиллуулах
npm install -g @anthropic-ai/claude-code
cd your-project
claude
Энэхүү хэрэгсэл нь IDE-аас салангид бие даасан хөгжүүлэлтийн агент болон ажиллах тул хөгжүүлэгчид том засваруудыг ард нь даалгаад орхих боломжийг олгож байна.
3. Бодит гүйцэтгэл ба Бенчмарк
SWE-bench Verified зэрэг бодит программ хангамжийн инженерчлэлийн сорилууд болон фронтэнд хөгжүүлэлтийн тестүүд дээр Claude 3.7 Sonnet өмнөх үеийн бүх загваруудыг илт тэргүүлжээ.
Cursor, Cognition (Devin-ийг бүтээгчид), Vercel, Replit зэрэг салбарын тэргүүлэх компаниуд уг загварыг урьдчилан туршиж, ялангуяа бүхэл бүтэн системийн full-stack код засвар, refactoring хийх тал дээр өнөөгийн зах зээл дээрх хамгийн өндөр нарийвчлалтай модель болохыг онцолсон байна.
4. Үнэ ба Хүртээмж
Anthropic загварынхаа үнийг өсгөөгүй бөгөөд Claude 3.5 Sonnet-той яг адил түвшинд хадгалжээ:
- Input: $3 / 1 сая токен
- Output (thinking токеныг оруулаад): $15 / 1 сая токен
Claude 3.7 Sonnet нь өнөөдрөөс эхлэн Claude вэб хувилбар, Anthropic API, Amazon Bedrock болон Google Cloud Vertex AI дээр шууд ашиглахад бэлэн болсон байна.
Дүгнэлт
Хөгжүүлэгчийн ажлын урсгал зөвхөн "code completion" хийдэг ко-пилот загвараас бүхэл бүтэн репозиторийг бие даан удирдах "Agentic" түвшин рүү бодитоор шилжиж байна. Claude 3.7 Sonnet-ийн hybrid бүтэц нь AI хөгжүүлэлтийн зардлыг хэмнэхийн зэрэгцээ инженерүүдэд өөрсдийн хүссэнээр сэтгэх гүнийг удирдах эрх чөлөөг олгож байна.
Эх сурвалж: Anthropic Official Announcement, Claude Developer Documentation.
Сэтгэгдэл
Ачаалж байна...