Мэдээ

OpenAI "GPT-5.6 Sol"-д зориулсан "Ultrafast" горимоо танилцууллаа: Секундэд 750 токен буюу 14 дахин хурдтай inference эрин эхэллээ

TOGTOKHTOGTOKH·2026 оны наймдугаар сарын 15·1 үзсэн·
OpenAI "GPT-5.6 Sol"-д зориулсан "Ultrafast" горимоо танилцууллаа: Секундэд 750 токен буюу 14 дахин хурдтай inference эрин эхэллээ

Хиймэл оюун ухаанд суурилсан бүтээгдэхүүн, multi-agent систем, кодын автоматжуулалт хөгжүүлж буй инженерийн багуудын өмнө тулгардаг хамгийн том бэрхшээл бол latency буюу хүлээлтийн хугацаа байсаар ирсэн. Олон алхамт шийдвэр гаргадаг agent-ууд ажиллах үед алхам бүрийн хоцрогдол нийлсээр бүхэл бүтэн минутуудыг шаарддаг нь бодит цагийн (real-time) үйлдлийн чанарыг бууруулдаг билээ.

OpenAI уг асуудлыг шийдвэрлэхээр хиймэл оюуны тусгай чип үйлдвэрлэгч Cerebras компанитай олон жилийн стратегийн түншлэл байгуулж, өөрсдийн тэргүүлэх GPT-5.6 Sol загварт зориулсан "Ultrafast" шинэ үйлчилгээний горимыг албан ёсоор танилцууллаа.

Энэхүү шинэчлэл нь загварыг жижигрүүлж "distill" хийх бус, харин жинхэнэ frontier түвшний том загварын хурдыг асар өндөр түвшинд хүргэснээрээ салбартаа онцгой үйл явдал болж байна.


Секундэд 750 токен: Энэ ямар түвшний үсрэлт вэ?

OpenAI API дээр туршилтын (preview) хэлбэрээр гарч буй Ultrafast горим нь секундэд 750 хүртэлх гаралтын токен (output tokens/sec) боловсруулах чадвартай.

Энэ үзүүлэлт нь:

  • GPT-5.6 Sol-ийн стандарт API горимоос (~53 токен/сек) даруй 14 дахин хурдан.
  • Өрсөлдөгч Claude Fable 5-аас 11 дахин, Opus 4.8 Fast горимоос 5 дахин хурдан үзүүлэлт юм.

"Humanity's Last Exam" (HLE) дээрх бодит туршилт:
Хими, эдийн засаг, инженерийн хамгийн хүнд 2,500 даалгавраас бүрдсэн HLE бенчмарк дээр туршихад GPT-5.6 Sol Ultrafast бүх даалгаврыг ердөө 11 цаг 11 минутад бодож дуусгажээ. Үүнтэй дүйцэхүйц нарийвчлалтайгаар гүйцэтгэсэн өрсөлдөгч Claude загварт 78 цаг гаруй (3 өдөр тасралтгүй тооцоолол) шаардагдсан бол Ultrafast нь нэг ажлын өдрийн дотор ижил түвшний судалгааг амжуулсан байна.


Технологийн гол нууц: Cerebras Wafer-Scale архитектур

Сүүлийн үед загваруудыг хурдлуулахын тулд ихэвчлэн параметрүүдийг цөөлөх, квантчилал хийх эсвэл spec-decoding аргуудыг ашигладаг байсан бол энэ удаад OpenAI тооцооллын дэд бүтцийн түвшинд шийдэл хийсэн байна.

Cerebras компанийн зохион бүтээсэн нэг цул цахиурын хавтан бүхий аварга том Wafer-Scale Engine процессорууд нь:

  1. Memory Bandwidth Bottleneck-ийг арилгасан: Уламжлалт GPU кластерууд хоорондын сүлжээний хоцрогдол (inter-chip interconnect latency)-ийг wafer түвшинд багасгаснаар санах ойноос өгөгдлийг гэрлийн хурдаар уншдаг.
  2. Чанарын алдагдалгүй (Zero Quality Degradation): Загварын бүтцийг тайрч жижгэрүүлээгүй тул нарийн тооцоолол, кодчилол, логик сэтгэлгээний чадвар стандарт горимтойгоо 100% ижил түвшинд хадгалагдсан.

Хөгжүүлэгчид болон Agent-уудад ямар боломж нээгдэх вэ?

Энэхүү 14 дахин хурдасгасан inference хөгжүүлэгчдийн өдөр тутмын ажилд дараах шууд өөрчлөлтүүдийг авчирна:

1. Олон алхамт Coding Agent-ууд хоромхон зуурт гүйцэтгэнэ

Кодын сангаас хайлт хийх, файлуудыг унших, алдааг оношлох, туршилтын тест бичих, засвар хийх зэрэг 10-20 алхам дамждаг agent-ийн ажил өмнө нь хэдэн минут болдог байсан бол одоо хэдхэн секундийн дотор дуусна.

2. Шуурхай алдаа илрүүлэлт ба Incident Response

OpenAI дотоод багтаа энэхүү горимыг продакшн системийн уналтын үед ашиглаж эхэлжээ. Системийн асар том log файлууд, сүүлийн үеийн code commit, stack trace-үүдийг нүд ирмэхийн зуур задлан шинжилж, root cause-ийг оношлон засварын PR-ийг бэлтгэхэд туслах юм.

3. Voice болон Interactive UI хоцрогдолгүй болно

Дуу хоолойгоор шууд харилцах болон хэрэглэгчийн үйлдэлд тулгуурлан UI-ийг dynamically үүсгэх бүтээгдэхүүнүүдэд "хүлээлтийн зогсолт" үгүй болж, хүнтэй ярьж буй мэт бодит туршлагыг бий болгоно.


Хэрхэн ашиглах вэ?

Одоогоор GPT-5.6 Sol Ultrafast нь OpenAI API-ийн сонгогдсон хөгжүүлэгчид болон энтерпрайз хэрэглэгчдэд зориулсан Limited Preview шатандаа байна. Түншлэлийн хүрээнд Cerebras нийт 750 мегаваттын хэт бага хоцрогдолтой тооцооллын хүчин чадлыг үе шаттайгаар нийлүүлэх тул ойрын хугацаанд бүх нийтийн API хандалт албан ёсоор нээгдэх юм.

Эх сурвалж: OpenAI API News, Cerebras Systems Announcement, Help Net Security, 36Kr Tech.

Сэтгэгдэл

Ачаалж байна...