Blog

OpenAI анхны AI чип "Jalapeño"-гоо дэлгэлээ: NVIDIA-ийн ноёрхлыг ганхуулах инференс архитектурBlog
Мэдээ

OpenAI анхны AI чип "Jalapeño"-гоо дэлгэлээ: NVIDIA-ийн ноёрхлыг ганхуулах инференс архитектур

OpenAI анхны бие даасан AI инференс чип болох "Jalapeño"-гийн архитектур болон туршилтын үр дүнг танилцууллаа. HBM4 санах ойтой, эрчим хүчний асар өндөр бүтээмжтэй уг чип нь AI агентуудын ажиллах зардлыг эрс бууруулах шинэ гарц нээж байна.

TOGTOKHTOGTOKH2026 оны наймдугаар сарын 31
OpenAI анхны AI инференс чип "Jalapeño"-гоо танилцууллаа: NVIDIA-ийн ноёрхолд хүчтэй цохилт өгөх үү?Blog
Мэдээ

OpenAI анхны AI инференс чип "Jalapeño"-гоо танилцууллаа: NVIDIA-ийн ноёрхолд хүчтэй цохилт өгөх үү?

OpenAI компани Broadcom-той хамтран зөвхөн LLM инференсэд зориулан бүтээсэн "Jalapeño" нэртэй анхны чип болон бодит тестийн үр дүнгээ зарлалаа. Энэхүү чип нь NVIDIA-ийн өнөөгийн тэргүүлэх системүүдээс эрчим хүчний хэмнэлт болон токен гаргалтын хурдаар хол давж байна.

TOGTOKHTOGTOKH2026 оны наймдугаар сарын 29
LLM инференсийн том толгойн өвчин шийдэгдэв: SGLang v0.5.18 загвар ачаалах хугацааг (Cold Start) 2.4 дахин буурууллааBlog
Мэдээ

LLM инференсийн том толгойн өвчин шийдэгдэв: SGLang v0.5.18 загвар ачаалах хугацааг (Cold Start) 2.4 дахин буурууллаа

Нээлттэй эхийн шилдэг LLM инференс фрэймворк болох SGLang шинэ хувилбараа гаргаж, жингүүдийг унших болон CUDA graph capture-ийг зэрэгцүүлснээр загвар ачаалах хугацааг 85 секундээс 35 секунд болгон буурууллаа.

TOGTOKHTOGTOKH2026 оны наймдугаар сарын 23
AI салбарт түүхэн эргэлт: Inference зардал анх удаа Training зардлыг давж, Хөгжүүлэгчдийн анхаарал Дэд Бүтэц рүү шилжлээBlog
Мэдээ

AI салбарт түүхэн эргэлт: Inference зардал анх удаа Training зардлыг давж, Хөгжүүлэгчдийн анхаарал Дэд Бүтэц рүү шилжлээ

Gartner-ийн сүүлийн тайлангаар AI Клауд дэд бүтцийн салбарт Inference буюу ашиглалтын зардал 23.3 тэрбум ам.долларт хүрч, Training буюу сургалтын зардлыг анх удаа давлаа. Энэ нь AI технологи туршилтын шатнаас бодит үйлдвэрлэлийн (production) ажиллагааны шат руу шилжсэнийг баталж байна.

TOGTOKHTOGTOKH2026 оны наймдугаар сарын 11
AMD Моделийн Жинг Цахиур Дээр "Сийлдэг" Taalas Стортапыг Худалдан Авлаа: AI Inference-ийн Шинэ АрхитектурBlog
Мэдээ

AMD Моделийн Жинг Цахиур Дээр "Сийлдэг" Taalas Стортапыг Худалдан Авлаа: AI Inference-ийн Шинэ Архитектур

AMD компани AI моделийн жинг программ хангамж түвшинд санамжид ачаалахын оронд цахиур чипний металл холбоосонд шууд сийлж үйлдвэрлэдэг Taalas стартапыг худалдан авлаа. Энэхүү технологи нь inference-ийн хурдыг 10-100 дахин нэмэгдүүлж, эрчим хүчний хэрэглээг асар ихээр бууруулах боломжтой.

TOGTOKHTOGTOKH2026 оны наймдугаар сарын 9