O'rin #7 Lokal / Shaxsiy SI — ongingiz, qurilmangiz, qoidalaringiz
Google DeepMind

Gemma 4

Bitta model emas — beshta. Google DeepMind'ning Gemma 4 turkumi byudjet smartfoningizda ishlaydigan 2 milliard parametrli jajji modeldan tortib, serverlar uchun mo'ljallangan 31 milliard parametrli qudratli tizimgacha bo'lgan hamma narsani qamrab oladi. Har bir a'zoning o'ziga xos arxitekturasi, kuchli tomonlari va apparat talablari bor. E2B 1 GB xotiraga sig'adi. 12B Unified noutbuk videokartasida to'liq multimodal sun'iy intellektni ishga tushiradi. 26B MoE esa har bir token uchun faqat 3.8B parametrni faollashtiradi. Barchasi Apache 2.0 litsenziyasida, barchasi ochiq kodli. Ushbu qo'llanma sizning qurilmangiz va vazifalaringizga qaysi Gemma aniq mos kelishini topishga yordam beradi.

Yangilangan 2026-yil 2-aprel (12B Unified: 3-iyun 2026-yil) MultimodalOpen WeightApache 2.0

Reyting yangilandi Bu sharh oxirgi marta yangilanganidan beri (2026-yil 2-aprel (12B Unified: 3-iyun 2026-yil)) «Lokal / Shaxsiy SI» reytingi qayta ko'rib chiqildi. Yuqorida ko'rsatilgan o'rin har doim dolzarb. Hozirgi 1-o'rin: Qwen3.8-27B

8.110 dan
Rasmiy veb-sayt
Eng mos

Bitta model emas — beshta. Google DeepMind'ning Gemma 4 turkumi byudjet smartfoningizda ishlaydigan 2 milliard parametrli jajji modeldan tortib, serverlar uchun mo'ljallangan 31 milliard parametrli qudratli tizimgacha bo'lgan hamma narsani qamrab oladi. Har bir a'zoning o'ziga xos arxitekturasi, kuchli tomonlari va apparat talablari bor. E2B 1 GB xotiraga sig'adi. 12B Unified noutbuk videokartasida to'liq multimodal sun'iy intellektni ishga tushiradi. 26B MoE esa har bir token uchun faqat 3.8B parametrni faollashtiradi. Barchasi Apache 2.0 litsenziyasida, barchasi ochiq kodli. Ushbu qo'llanma sizning qurilmangiz va vazifalaringizga qaysi Gemma aniq mos kelishini topishga yordam beradi.

Nima uchun bu eng yaxshisi

Telefondan noutbuk va servergacha bo'lgan beshta model. 12B Unified: enkoderlarsiz multimodallik, QAT bilan ~7 GB VRAM, oddiy videokartalarda 100+ token/s tezlik. E2B telefonlarda 1 GB xotirada ishlaydi. E4B smartfonda AIME 2026 testida 42.5% natija qayd etdi. 26B MoE ancha kam hisoblash quvvati evaziga 31B sifatining ~97% ni bera oladi. 31B ochiq modellar orasida top-3 likka kiradi. Barchasi Apache 2.0 asosida. Barchasi 140+ tilni qo'llab-quvvatlaydi.

E'tibor bering

Beshta model besh xil murosani (trade-off) anglatadi. Telefon uchun mo'ljallangan modellar chuqur fikrlashdan voz kechadi. 12B uchun yaxshi GPU kerak. 26B/31B ga esa jiddiy VRAM zarur. Bitta model hamma ishni eplay olmaydi — o'z qurilmangizga mosini tanlashingiz kerak. Eng silliq ishlashi uchun Google vositalaridan foydalanish tavsiya etiladi.

01

Aslida bu nima

Aksariyat AI modellari premyerasida sizga bitta model beriladi va bitta tanlov qo’yiladi: undan foydalaning yoki yo’q. Gemma 4 esa sizga beshta model berib, umuman boshqa savolni o’rtaga tashlaydi: sizda o’zi qanday qurilma bor?

Bu oddiy reklama gaplariga o’xshashi mumkin, ammo butun oilaning eng foydali tomoni ham aslida shunda. Har bir a’zoning qurilish poydevori (arxitekturasi) boshqacha — ular shunchaki bitta modelning kattalashtirilgan nusxasi emas. Telefon modellari Per-Layer Embeddings (har bir qatlam uchun alohida xotira) ishlatsa, 12B modeli ko’rish va ovoz eshitish uchun alohida detallardan butunlay voz kechgan. 26B esa ma’lumotni 128 ta turli xil “mutaxassislar” (ekspertlar) aralashmasi orqali yo’naltiradi. 31B bo’lsa, har bir so’zni tushunish uchun o’zidagi barcha 30.7 milliard turnikini baravariga ishga tushiradi. Bitta oila, turlicha muhandislik g’oyalari va turli maqsadli yechimlar.

Keling, ularni birma-bir ko’rib chiqamiz.

E2B — Cho’ntagingizdagi sun’iy intellekt (~1 GB RAM)

Eng mitti Gemma 4. Kvantlangan (siqilgan) holatda taxminan 1 GB xotiraga sig’adigan ikki milliard parametr. U matnni, rasmlarni va jonli ovozni tushunadi — hammasini telefoningizning o’zida, internetsiz bajaradi. U qiyin matematika testi AIME 2026 da 37.5% natija ko’rsatgan, Raspberry Pi kabi jajji kompyuterda ishlaydigan dastur uchun bu hayratlanarli raqamdir. Uning siri Per-Layer Embeddings (PLE) deb ataladigan tizimda — u parametrlar sonini shishirmasdan turib, har bir qatlamga o’z xotirasini beradi va maksimal aqlni siqib chiqaradi. Bu model bilan katta kompyuterda o’tirgandek ishlay olmaysiz, biroq hamyonbop telefonda rasmga qarab savol berish, ovozli buyruqlar va tezkor tarjimalar uchun u naqadar foydali.

E4B — Telefoningiz qudrati (4–6 GB RAM)

E4B — telefon uchun optimallashtirilgan modelga haqiqatda fikr yuritish uchun yetarlicha imkoniyat berilsa, nima bo’lishining yaqqol isbotidir. U AIME 2026 testida 42.5% ball oldi — bu undan ancha yirikroq bo’lgan Gemma 3 ning 27B modelidan ikki barobar kuchliroq degani. Matn, rasm va ovozni lokal darajada qayta ishlaydi, 128K kontekst xotirasi (butun boshli kitobni eslab qolish qobiliyati) bor va qadam-baqadam o’ylaydigan maxsus fikrlash rejimini o’z ichiga oladi. Agar sizda 8 GB RAM’ga ega zamonaviy kuchli smartfoningiz bo’lsa, bu “shunchaki telefonimdan oflayn so’rab ko’raman” degan gapni, shunchaki o’yinchoq emas, jiddiy, kuchli vositaga aylantiradigan yordamchidir.

12B Unified — Maxfiylikni ta’minlovchi noutbuk agentlar motori (~7 GB VRAM, QAT bilan)

Mana shu joyda Gemma 4 ko’pchilikni o’ziga jalb qiladi. 2026-yil 3-iyunda e’lon qilingan 12B Unified o’z tengqurlari orasida mutlaqo takrorlanmas ish qildi: u matn, rasm va ovozni o’rtakash enkoderlarsiz bitta transformator yordamida o’zlashtiradi. Oddiy rasm bo’laklari va ovoz to’lqinlari yengil qatlamlar orqali to’g’ridan-to’g’ri model ongiga kirib boradi. Oddiyroq arxitektura, javob berish vaqtining qisqarishi va uni o’zingizga moslashtirishning (fine-tuning) osonlashgani — uning asosiy yutug’i.

Raqamlarga yuzlansak: 77.2% MMLU Pro, 77.5% AIME 2026, 72.0% LiveCodeBench, 78.8% GPQA Diamond. Google uning 26B MoE modeliga “xotiraning yarmini band qilgan holda” yelma-yelak yetib kelganini aytmoqda. 5-iyunda chiqqan rasmiy QAT (siqilgan) varianti bilan Q4_0 versiyasi endi taxminan 6.7 GB VRAM so’raydi xolos. Uni Multi-Token Prediction (bir vaqtda bir nechta so’zni taxmin qilish) bilan birga ishlatsangiz, RTX 4070 Super kabi 12 GB VRAM’ga ega kartalarda soniyasiga 100–130+ token tezlikda yozadi. U hatto alohida videokartasi yo’q, lekin 16 GB birlashtirilgan xotirasi bor noutbuklarda (masalan, Mac) ham ishlayveradi.

Agar kompyuteringizda mustaqil ishlaydigan AI yordamchilari, maxfiy ovozli yordamchi yoki begonalarga ko’rsatilmaydigan shaxsiy kodlash dasturlari kerak bo’lsa va bulutga bog’lanib qolishni istamasangiz — aynan shu model siz uchun.

26B MoE — Samaradorlik bo’yicha ekspert (kvantlangan 15–18 GB VRAM)

26B modelida jami 26 milliard parametr bor, lekin bu yerda bitta zo’r fokus bor: har bir so’z (token) chiqqanda uning faqat 3.8 milliardi ishga tushadi. Aqlli “marshrutizator” tizimi ichkaridagi 128 ta mutaxassis (ekspert) tarmog’idan har gal eng kerakli 2 tasinigina chaqiradi va kompyuter kuchini tejagan holda deyarli 31B sifatiga erishadi. Tasavvur qiling, sizning ulkan binoda turli mutaxassislaringiz bor va savolga javob berish uchun har safar faqat shu savolga usta bo’lgan ikkitasini ofisga chaqirasiz.

U matn, rasm va videoni ham (kichik modellar kabi faqat ovozni emas) tushunadi, 256K kontekst (uzun xotira) oynasiga ega va Arena AI ochiq reytingida 6-o’rinda turibdi. Buning badali faqat xotira bilan to’lanadi — sizga siqilgan (kvantlangan) 15-18 GB xotira, ya’ni RTX 4090, RTX 5060 Ti 16 GB yoki 32 GB xotirali Mac kerak bo’ladi. Agar kompyuteringiz ko’tarsa va siz elektrni tejab, sifatli natija kutmoqchi bo’lsangiz, bu model qidirganingizdir.

31B Dense — Murosasiz gigant (kvantlangan 16–20 GB VRAM)

Hech qanday marshrutizator, ekspertlar aralashmasi yoki aylanib o’tishlar yo’q. 31B Dense har bir so’z uchun o’zining barcha 30.7 milliard parametrlarini to’liq kuch bilan ishga soladi. Bu Gemma 4 oilasining haqiqiy cho’qqisi bo’lib, barcha ochiq modellar ichida Arena AI da 3-o’rinni egallab turibdi va qiyin matematika testi AIME 2026 da 89.2% olgan. Modallik jihatdan u ham 26B bilan bir xil (matn, rasm, video), bir xil 256K uzun xotira oyna, biroq har bir savolda u barcha aqlini bir joyga yig’ib to’liq chuqur mulohaza yuritadi.

Uning yagona qimmatli tomoni kompyuterning kuchidir. BF16 rejimida bu ulkan “miya” 71 GB VRAM talab qiladi (bu butun boshli biznes-server degani). Biroq uni INT4 darajasigacha siqsangiz, u 16-20 GB xotiraga bemalol joylashadi, shunda uni oddiy odamlar ishlatadigan kuchli kompyuterlarda ham yurgizish mumkin. Agar texnik imkoniyatingiz yetsa va sizga tezlikdan ko’ra javobning xatosiz, sifatli bo’lishi muhimroq bo’lsa, bu yopiq pullik bulutli modellarga tenglasha oladigan ajoyib ochiq yechimdir.

Xo’sh, qaysi birini tanlash kerak?

Mana halol tanlov varaqasi:

  • Telefon, oflayn, tezkor mayda vazifalar → E4B (yoki o’ta kuchsiz, eski telefonlar uchun E2B)
  • Noutbuk, 8–12 GB videokarta → 12B Unified (QAT versiyasi)
  • Noutbuk, 16 GB oddiy xotira (Mac), videokarta yo’q → 12B Unified (QAT versiyasi) (biroz sekinroq ishlaydi, lekin qoyilmaqom eplaydi)
  • Ish stansiyasi kompyuter, RTX 4090 / 32 GB Mac → 26B MoE (vattiga eng sifatli natija)
  • Server yoki kuchli ish stansiyasi → 31B Dense (maksimal sifat, kompromissiz natija)

Beshala model ham Apache 2.0 litsenziyasiga ega (erkin foydalanish), 140 dan ortiq tillarni qo’llab-quvvatlaydi, shuningdek Ollama, llama.cpp, LM Studio, vLLM kabi dasturlar va Google’ning AI Edge yordamchi to’plamlari bilan bemalol kelishib ishlaydi. Oila a’zolari o’z tuzilishida bir-biriga qo’shilmasligi mumkin, lekin bitta kuchli g’oyada mudom birlashadi: begonalarning bulutida emas, o’z kompyuteringizda siz uchun ishlaydigan haqiqiy jiddiy sun’iy intellekt.

02

Kuchli tomonlar va halol cheklovlar

Asosiy afzalliklari

  • E2B — byudjet telefonlari uchun AI (1 GB RAM): Oila a’zolarining eng kichigi siqilgan (kvantlangan) holatda atigi 1 GB xotiraga sig’adi. Matn, rasm va audio — barchasi telefoningizning o’zida, internetsiz ishlaydi. AIME 2026 testida 37.5% natija ko’rsatdi, bu ikki yil oldin ish stoli kompyuterlari uchun ham ajoyib natija bo’lar edi. Eng kam parametrlardan maksimal aqlni siqib chiqarish uchun Per-Layer Embeddings (PLE) texnologiyasidan foydalanadi. IoT, Raspberry Pi va hamyonbop Android qurilmalari uchun ayni muddao.
  • 12B Unified Multimodal va noutbuk agentlari motori: Gemma 4 matn, audio va tasvirlarni enkoderlarsiz to’g’ridan-to’g’ri qabul qiladigan 12B Unified modelini taqdim etadi. LiteRT-LM orqali lokal ishlash uchun optimallashtirilgan ushbu model noutbuklarda bulutga umuman ulanmasdan, to’liq maxfiylik bilan aqlli AI agentlarini ishga tushiradi.
  • E4B — flagman telefon AI (4–6 GB RAM): Smartfonlar uchun eng zo’r muvozanat. AIME 2026 testida 42.5% natija oldi — bu Gemma 3’ning 27B modelidan ikki barobar kuchli degani. Matn, rasm va audioni to’g’ridan-to’g’ri tushunadi. 128K kontekst xotirasi bor. Murakkab vazifalar uchun o’rnatilgan fikrlash (thinking) rejimi mavjud. Bu butunlay oflayn, to’g’ridan-to’g’ri telefoningizda ishlaydigan chinakam qobiliyatli sun’iy intellekt yordamchisidir. Agar sizda zamonaviy kuchli smartfon bo’lsa, bu aynan sizning modelingiz.
  • 12B Unified — maxfiylikni ta’minlovchi noutbuk agentlar motori (~7 GB VRAM, QAT bilan): Oilaning haqiqiy yulduzi. Enkodersiz arxitektura — alohida tasvir yoki audio enkoderlar yo’q. Bitta transformer matn, tasvir va audioni birdaniga qabul qiladi. QAT versiyasi ~6.7 GB VRAM (Q4_0) da ishlaydi, ya’ni u 12 GB RTX 4070 yoki 16 GB birlashtirilgan xotirali noutbukka bemalol sig’adi. MTP spekulyativ dekodlash yordamida soniyasiga 100–130+ token tezlikka erishadi. MMLU Pro’da 77.2%, AIME 2026’da 77.5%, LiveCodeBench’da 72.0% natija qayd etgan. Bulutga birorta ham bayt ma’lumot yubormasdan, avtonom kodlash agentlari va ovozli jarayonlarni ishga tushirish uchun mukammal moslashgan.
  • 26B MoE — ish stansiyasi samaradorligi (kvantlangan 15–18 GB VRAM): Jami 26 milliard parametrga ega, biroq har bir token uchun faqat 3.8 milliard parametr faollashadi. Aqliy router (yo’naltiruvchi) har bir qatlamdagi 128 ta ekspertdan kerakli 2 tasini tanlaydi va bu orqali ancha kam hisoblash xarajati evaziga 31B sifatiga yaqin natija beradi. Matn, rasm va videoni tushunadi. 256K kontekst oynasi. Ochiq modellar reytingida 6-o’rinda. Sifat va sarflangan energiya nisbatining eng ma’qulini izlayotgan, RTX 4090 yoki 32 GB Mac kompyuteriga ega dasturchilar uchun ideal.
  • 31B Dense — sifat cho’qqisi (kvantlangan 16–20 GB VRAM): Har bir tokenda barcha 30.7 milliard parametr ishga tushadi. Hech qanday router, hech qanday aylanib o’tishlar yo’q — har bir qadamda maksimal fikrlash chuqurligi. Ochiq modellar orasida 3-o’rinni egallab turibdi. AIME 2026 da 89.2% natija. Matn, rasm va video tushunadi. 256K kontekst. Agar sizda kuchli VRAM (RTX 4090 yoki 64 GB Mac) bo’lsa, bu model tijoriy bulutli modellarga eng yaqin kela oladigan ochiq modeldir.

Haqiqiy cheklovlar

  • Edge (telefon) modellar chuqurlikdan voz kechadi: E2B va E4B murakkab fikrlash, ko’p bosqichli kodlash yoki chuqur tahlil masalasida 12B modeliga yeta olmaydi. Ular eng yuqori sifat uchun emas, balki qurilma xotirasida o’zini oqlashi uchun yaratilgan. Tezkor vazifalar uchun ajoyib, ammo chuqur tadqiqot uchun emas.
  • 12B ga haqiqiy videokarta (yoki kuchli noutbuk) kerak: QAT texnologiyasi bilan bo’lsa ham, uni ishlatish uchun sizga kamida 7 GB bo’sh VRAM kerak. Bu degani sizga GTX 1080+ darajasidagi maxsus videokarta yoki 16 GB birlashtirilgan xotirali Mac kerak bo’ladi. Oddiy o’rnatilgan grafika bilan tezlik qoniqarsiz bo’ladi.
  • 26B/31B modellari o’ta jiddiy qurilma talab qiladi: Kvantlangan holatda ham 15–20 GB VRAM kerak bo’ladi. Kvantlanmagan sof (BF16) 31B modeliga esa taxminan 71 GB kerak. Bular qimmatbaho ish stansiyalari yoki top noutbuklar uchun mo’ljallangan — oddiy kompyuterlar buni ko’tara olmaydi.
  • Kichik modellar videoni tushunmaydi: Videoni ko’rib tahlil qilish faqat 26B va 31B modellaridagina bor. Kichikroq modellar faqat matn, rasm va audioni eplay oladi.
  • Google dasturlari tavsiya etiladi: MediaPipe, LiteRT, Google AI Edge SDK va AI Studio orqali eng yaxshi va barqaror ishlaydi. Ollama, llama.cpp va LM Studio’da ham muammosiz ishlaydi-yu, lekin Google optimallashtirgan tizimga nisbatan ba’zan mayda kamchiliklar uchrashi mumkin.
  • Uzoq muddatli marafonlar uchun emas: Kunlar davomida tinimsiz ishlaydigan kuchli bulutli kodlash agentlaridan farqli o’laroq, Gemma 4 qisqa va bir nechta savol-javobli interaksiyalar uchun qurilgan — tinimsiz, o’z-o’zidan ishlaydigan agent marafonlari uchun emas.
03

Benchmark natijalari

AIME 2026 — 31B: 89.2%, 12B: 77.5%, E4B: 42.5%, E2B: 37.5%

Qiyin darajadagi matematika. Telefon o'lchamidan tortib server darajasigacha bo'lgan butun oila bo'ylab aniq sifat o'sishini ko'rsatadi. 12B noutbukning o'zida jiddiy matematiklarni ham hayratda qoldiradi.

MMLU Pro — 12B: 77.2%

Professional darajadagi bilim va mantiq. 12B modeli xotirani ikki barobar kam sarflagan holda 26B MoE modeliga deyarli yetib oladi (uning natijasining ~97% qismi). Har bir parametr hisobiga to'g'ri keladigan aql barchasini lol qoldiradi.

LiveCodeBench v6 — 12B: 72.0%

Haqiqiy sharoitdagi kod yozish qobiliyati. 12B bu — internetga mutlaqo qaram bo'lmagan, kundalik dasturlash ishlarini eplay oladigan chinakam ajoyib shaxsiy yordamchi.

GPQA Diamond — 12B: 78.8%

Aspirantura darajasidagi qiyin ilmiy savollar. Bir yil oldin faqat kuchli serverlardagi modellar ko'rsata olgan natijani endi siqilgan holatda (QAT) oddiy noutbuklar ham bera oladi.

Arena AI — 31B: #3, 26B MoE: #6 (ochiq modellar)

Odamlar tomonidan yuzma-yuz solishtiriladigan reyting. 31B ochiq modellar orasida eng zo'rlaridan biri; 26B MoE esa ancha kam elektr xarajati bilan undan atigi 1-2% orqada.

Codeforces ELO — 12B: 1659

Raqobatbardosh sport dasturlash. Noutbukning o'zida ham ancha murakkab algoritmik muammolarni yechish uchun yetarli darajada kuchli. 26B va 31B esa undan ham baland ball to'playdi.

04

Xulosa

Gemma 4 — joriy yilda taqdim etilgan eng amaliy ochiq modellar oilasidir. Buning sababi, qaysidir bitta model hamma narsani mukammal qila olganida emas, balki har bir vaziyat va qurilma uchun mos bitta Gemma topilishidadir. Telefoningizga oflayn yordamchi quryapsizmi? E4B’ni oling. 12 GB VRAM’li noutbukingizda shaxsiy, maxfiy kodlash yordamchisi kerakmi? 12B Unified ayni muddao. RTX 4090 videokartali ish stansiyasida eng tejamkor va kuchli yordamchi izlayapsizmi? 26B MoE’ni tanlang. Haqiqiy kompromissiz, eng yuqori aqlni xohlaysizmi? 31B Dense aynan siz uchun. Ularning arxitekturasi turlicha (PLE, enkodersiz, MoE, Dense), apparat talablari xilma-xil (1 GB dan 71 GB gacha), lekin ular bitta litsenziyani (Apache 2.0), bir xil ko’p tillilikni (140+ til) va bir xil asosiy qoidani baham ko’radilar: kimningdir begonaning bulutida emas, o’z kompyuteringizda ishlaydigan haqiqiy jiddiy sun’iy intellekt.

05

Ko'p so'raladigan savollar