OpenAI Түүхэн Алхам Хийлээ: Apache 2.0 Лицензтэй, Локалоор Ажиллах "gpt-oss-20b" ба "120b" Reasoning Моделиуд Гарлаа
Хиймэл оюуны салбарын хамгийн хаалттай гигантуудын нэг байсан OpenAI компани нээлттэй эхийн (open-source) хөгжүүлэгчдийн нийгэмлэг рүү чиглэсэн түүхэн алхмаа хийлээ. Тэд gpt-oss-120b болон gpt-oss-20b нэртэй, бүрэн нээлттэй жинтэй (open-weight) reasoning моделиудаа албан ёсоор танилцуулж, Apache 2.0 лицензтэйгээр HuggingFace болон GitHub дээр нийтэллээ.
Энэхүү алхам нь DeepSeek, Meta Llama, Qwen зэрэг нээлттэй моделиудын хүчтэй давалгаанд OpenAI-аас өгч буй шууд хариу бөгөөд хөгжүүлэгчдэд дата төв болон хувийн компьютер дээрээ OpenAI түвшний сэтгэх чадвартай загварыг датагаа нууцлан үнэгүй ажиллуулах боломжийг олгож байна.
Архитектур ба Техник Үзүүлэлт: Хэрэглэгчийн Карт Дээр Ажиллана
Шинэ gpt-oss цуврал нь Mixture-of-Experts (MoE) архитектурт суурилсан бөгөөд дараах хоёр хувилбартай:
- gpt-oss-20b: Нийт 21 тэрбум параметр бүхий MoE загвар бөгөөд нэг токен дээр идэвхтэй ажиллах нь ердөө 3.6 тэрбум параметр. Хамгийн чухал нь 16GB VRAM-тай хэрэглэгчийн GPU (жишээ нь RTX 4080, Apple Silicon Mac M-цуврал) дээр ямар ч хүндрэлгүй ажиллана.
- gpt-oss-120b: 117 тэрбум параметрийн багтаамжтай том загвар. Суурилагдсан MXFP4 квантчлалын (quantization) ачаар ердөө нэг ширхэг 80GB VRAM-тай GPU (NVIDIA H100 эсвэл AMD MI300X) дээр бүрэн багтаж, дата төвийн зардлыг үлэмж хэмжээгээр бууруулна.
Хоёр загвар хоёулаа 131,072 токены урттай (128k context window) бөгөөд агентын даалгавар, код бичих, алгоритм шийдвэрлэхэд зориулагдсан байна.
Бүрэн Ил Тод Chain-of-Thought ба Агентын Чадвар
Өмнө нь OpenAI өөрсдийн хаалттай o1, o3 зэрэг загваруудын бодох явцыг (Chain-of-Thought) хөгжүүлэгчдээс нуудаг байсан бол gpt-oss дээр бүрэн задгай ил тод болгожээ.
- Reasoning Effort тохируулга: Хөгжүүлэгчид загварын сэтгэх гүнийг Low, Medium, High гэсэн түвшнээр зааж өгөх боломжтой. Энгийн асуултад шуурхай хариулах бол логик өндөртэй кодонд бодолтын алхмуудыг нэмэгдүүлнэ.
- Дебаг хийх таатай нөхцөл: Загвар яагаад ийм шийдэлд хүрсэн бүх бодлын логик дэс дарааллыг алхам алхмаар харах боломжтой тул AI агент бүтээх, нарийн алдаа илрүүлэхэд асар том давуу тал олгоно.
- Нутгийн багаж дуудах (Native Tool Use): Загварууд нь Python кодын гүйцэтгэл (Code Execution), веб хайлт хийх болон OpenAI-ийн шинэ Harmony форматын Structured Outputs-ийг native түвшинд дэмжинэ.
Бенчмарк Үзүүлэлтүүд: Хаалттай Моделиудтай Өрсөлдөхүйц
OpenAI-ийн танилцуулсан үнэлгээний дүнгээр gpt-oss-120b нь GPT-4-mini болон зах зээл дээрх бусад нээлттэй том загваруудыг reasoning сорилуудад давж байна:
- MMLU (Мэдлэг ба ойлголт): gpt-oss-120b — 90.0%, gpt-oss-20b — 85.3%
- GPQA Diamond (Шинжлэх ухааны логик): gpt-oss-120b — 80.1%
- AIME 2024 (Математикийн олимпиад): gpt-oss-120b — 96.6%, gpt-oss-20b — 96.0%
- Humanity's Last Exam: gpt-oss-120b — 19.0%
Энэ нь ялангуяа програмчлалын алгоритм зохиох, математик загварчлал, архитектурын шийдвэр гаргалтад жижиг 20B загвар ч гайхалтай үр дүн үзүүлэхийг харуулж байна.
Хөгжүүлэгчид Одооноос Хэрхэн Ашиглах Вэ?
Apache 2.0 лиценз нь уг загварыг ямар нэг хязгаарлалтгүйгээр арилжааны бүтээгдэхүүнд ашиглах, өөрчлөх, өөрсдийн дата дээр Full-parameter fine-tuning хийх боломжийг олгодог.
Хөгжүүлэгчид үүнийг аль хэдийн дараах хэрэгслүүдээр ашиглаж эхлээд байна:
1. Ollama ашиглан локал ажиллуулах:
ollama run gpt-oss:20b
2. HuggingFace Transformers ашиглан Python дээр дуудах:
from transformers import pipeline
import torch
pipe = pipeline(
"text-generation",
model="openai/gpt-oss-20b",
torch_dtype="auto",
device_map="auto"
)
messages = [
{"role": "user", "content": "Бичил үйлчилгээний архитектурт event sourcing хэрхэн оновчтой хэрэгжүүлэх вэ?"}
]
outputs = pipe(messages, max_new_tokens=512)
print(outputs[0]["generated_text"][-1]["content"])
Дүгнэлт: Open-Source AI-ийн Шинэ Эрин
gpt-oss гарснаар банк, эрүүл мэнд, финтек зэрэг гадагшаа дата гаргах хориотой байгууллагууд OpenAI түвшний reasoning моделийг дотоод сервертээ найдвартай байршуулах үүд хаалга нээгдлээ. Өндөр үнэтэй API токен төлбөрөөс татгалзаж, хувийн сервер дээрээ AI агентууд бүтээх хүсэлтэй хөгжүүлэгчдийн хувьд энэ нь оны хамгийн том техникийн эргэлт болж байна.
Эх сурвалж: OpenAI Official Release Blog & Model Card (openai/gpt-oss), HuggingFace, GitHub Community Repositories.
Сэтгэгдэл
Ачаалж байна...