Google шинэ үеийн "Gemini 3.7 Flash" моделио цацлаа: Кодчилол ба агентуудад зориулсан хэт хямд, хүчирхэг шийдэл
Хиймэл оюун ухааны загваруудын өрсөлдөөн зөвхөн "хэн хамгийн ухаалаг вэ" гэсэн тулаанаас хальж, бодит хөгжүүлэлтийн орчинд "хэн хамгийн хурдан, хямд бөгөөд найдвартай ажиллах вэ" гэдэг шалгуур руу бүрэн шилжээд байна.
Google компани сүүлийн 24 цагийн дотор өөрсдийн Flash цувралын хамгийн сүүлийн хувилбар болох Gemini 3.7 Flash моделио албан ёсоор танилцуулж, API болон хөгжүүлэгчдийн платформуудаар дамжуулан ашиглалтад орууллаа. Энэхүү хувилбар нь ялангуяа программ хангамжийн инженерчлэл, бие даасан AI агент (agentic workflows) болон баримт бичгийн гүн боловсруулалтад зориулагдан оновчлогдсоноороо онцлогтой юм.
Үндсэн үзүүлэлтүүд ба Архитектурын онцлог
Gemini 3.7 Flash нь цоо шинэ pre-training биш бөгөөд өмнөх 3.6 суурийн reasoning (учир шалтгааныг эргэцүүлэн бодох) алгоритмыг дахин сайжруулж гаргасан хувилбар юм.
Загварын техникийн гол үзүүлэлтүүдийг дурдвал:
- Контекст цонх (Context Window): 1,000,000 токен хүртэлх multimodal (текст, зураг, аудио, видео) оролтыг хүлээн авна.
- Гаралтын хязгаар (Max Output): Нэг хүсэлтээр 64,000 хүртэлх токен үүсгэх чадвартай (бүхэл бүтэн модуль, том хэмжээний кодын бааз зэрэг үүсгэхэд нэн тохиромжтой).
- Customizable Thinking Mode: Хөгжүүлэгч тухайн даалгаврын цар хүрээнээс хамааруулан загварын "эргэцүүлэн бодох хугацаа/тооцоолол"-ыг өөрөө тохируулах боломжтой. Энэ нь latency (хүлээгдэх хугацаа) болон үр дүнгийн чанарын хооронд төгс тэнцвэрийг барих боломжийг олгодог.
// Жишээ: API дээр thinking тохиргоог удирдах
{
"model": "gemini-3.7-flash",
"contents": [...],
"generationConfig": {
"thinkingConfig": {
"thinkingBudget": 4096 // Бодох токений лимитийг зааж өгөх
},
"maxOutputTokens": 64000
}
}
Инженерчлэлийн бенчмарк: FrontierCode дээрх үсрэлт
Программ хангамжийн бодит кодын чанарыг шалгадаг FrontierCode 1.1 Main бенчмарк дээр Gemini 3.7 Flash нь 43.6%-ийн үнэлгээ авч, өмнөх 3.6 Flash хувилбарын 34.4%-ийг мэдэгдэхүйц давуулсан байна.
Энэхүү оноо нь загвар зөвхөн энгийн синтакс бичих төдий бус, олон файл дамжсан архитектурын хамаарлыг ойлгох, refactoring хийх, репозитор дахь edge case алдаануудыг олж засах чадвар бодитоор нэмэгдсэнийг харуулж байна. Мөн загвар UI mockup зураг эсвэл дизайны системээс шууд frontend кодын бүтэц үүсгэхэд маш өндөр нарийвчлалтай ажилладаг болжээ.
Үнийн түрэмгий дайн: Токен тутмын зардал 50% буурав
Энэхүү нээлтийн хамгийн том давуу тал нь түүний өртөг юм. Google үнийн хувьд өрсөлдөгчдөө маш хүчтэй шахаж эхэллээ:
- Оролт (Input Tokens): 1 сая токен тутамд $0.75
- Гаралт (Output Tokens): 1 сая токен тутамд $3.75
Энэ нь өмнөх үеийн Flash хувилбараас бараг 2 дахин хямдарсан төдийгүй зах зээл дээрх Claude Sonnet болон GPT түвшний reasoning загваруудын дундаж өртгөөс даруй 3 дахин бага үнэ юм.
24/7 тасралтгүй ажилладаг coding agent, CI/CD pipeline дээр автоматаар pull request шалгаж тест ажиллуулдаг системүүдийн хувьд энэ нь дэд бүтцийн зардлыг үлэмж хэмжээгээр хэмнэх бодит боломж болж байна.
Хөгжүүлэгчид хэрхэн нэвтрүүлж эхлэх вэ?
Gemini 3.7 Flash нь дараах сувгуудаар олон нийтэд нээлттэй болсон байна:
- Google AI Studio & Gemini API: Хөгжүүлэгчид өөрсдийн API түлхүүрээрээ шууд REST болон SDK-ээр дамжуулан ашиглах боломжтой.
- Android Studio: Мобайл болон системийн инженерүүдэд зориулсан IDE түвшний дэмжлэг.
- Gemini Enterprise Agent Platform: Байгууллагын түвшний автоном ажлын урсгал, баримт бичгийн pipeline автоматжуулалт хийхэд зориулагдсан.
Open weights (нээлттэй жин)-ээр гараагүй, бүрэн хост хийгдсэн API хэлбэрээр ажиллах тул on-premise орчинд өөрсдөө байршуулах шаардлагатай багуудад тохирохгүй ч, cloud-native болон serverless микросервис хөгжүүлж буй багуудын хувьд өнөөдрөөс эхлэн хамгийн өндөр ROI (Return on Investment) авчрах сонголт болж байна.
Эх сурвалж: Google AI / MarkTechPost (Gemini 3.7 Flash Release Notes)
Сэтгэгдэл
Ачаалж байна...