Aksariyat AI modellari premyerasida sizga bitta model beriladi va bitta tanlov qo’yiladi: undan foydalaning yoki yo’q. Gemma 4 esa sizga beshta model berib, umuman boshqa savolni o’rtaga tashlaydi: sizda o’zi qanday qurilma bor?
Bu oddiy reklama gaplariga o’xshashi mumkin, ammo butun oilaning eng foydali tomoni ham aslida shunda. Har bir a’zoning qurilish poydevori (arxitekturasi) boshqacha — ular shunchaki bitta modelning kattalashtirilgan nusxasi emas. Telefon modellari Per-Layer Embeddings (har bir qatlam uchun alohida xotira) ishlatsa, 12B modeli ko’rish va ovoz eshitish uchun alohida detallardan butunlay voz kechgan. 26B esa ma’lumotni 128 ta turli xil “mutaxassislar” (ekspertlar) aralashmasi orqali yo’naltiradi. 31B bo’lsa, har bir so’zni tushunish uchun o’zidagi barcha 30.7 milliard turnikini baravariga ishga tushiradi. Bitta oila, turlicha muhandislik g’oyalari va turli maqsadli yechimlar.
Keling, ularni birma-bir ko’rib chiqamiz.
E2B — Cho’ntagingizdagi sun’iy intellekt (~1 GB RAM)
Eng mitti Gemma 4. Kvantlangan (siqilgan) holatda taxminan 1 GB xotiraga sig’adigan ikki milliard parametr. U matnni, rasmlarni va jonli ovozni tushunadi — hammasini telefoningizning o’zida, internetsiz bajaradi. U qiyin matematika testi AIME 2026 da 37.5% natija ko’rsatgan, Raspberry Pi kabi jajji kompyuterda ishlaydigan dastur uchun bu hayratlanarli raqamdir. Uning siri Per-Layer Embeddings (PLE) deb ataladigan tizimda — u parametrlar sonini shishirmasdan turib, har bir qatlamga o’z xotirasini beradi va maksimal aqlni siqib chiqaradi. Bu model bilan katta kompyuterda o’tirgandek ishlay olmaysiz, biroq hamyonbop telefonda rasmga qarab savol berish, ovozli buyruqlar va tezkor tarjimalar uchun u naqadar foydali.
E4B — Telefoningiz qudrati (4–6 GB RAM)
E4B — telefon uchun optimallashtirilgan modelga haqiqatda fikr yuritish uchun yetarlicha imkoniyat berilsa, nima bo’lishining yaqqol isbotidir. U AIME 2026 testida 42.5% ball oldi — bu undan ancha yirikroq bo’lgan Gemma 3 ning 27B modelidan ikki barobar kuchliroq degani. Matn, rasm va ovozni lokal darajada qayta ishlaydi, 128K kontekst xotirasi (butun boshli kitobni eslab qolish qobiliyati) bor va qadam-baqadam o’ylaydigan maxsus fikrlash rejimini o’z ichiga oladi. Agar sizda 8 GB RAM’ga ega zamonaviy kuchli smartfoningiz bo’lsa, bu “shunchaki telefonimdan oflayn so’rab ko’raman” degan gapni, shunchaki o’yinchoq emas, jiddiy, kuchli vositaga aylantiradigan yordamchidir.
12B Unified — Maxfiylikni ta’minlovchi noutbuk agentlar motori (~7 GB VRAM, QAT bilan)
Mana shu joyda Gemma 4 ko’pchilikni o’ziga jalb qiladi. 2026-yil 3-iyunda e’lon qilingan 12B Unified o’z tengqurlari orasida mutlaqo takrorlanmas ish qildi: u matn, rasm va ovozni o’rtakash enkoderlarsiz bitta transformator yordamida o’zlashtiradi. Oddiy rasm bo’laklari va ovoz to’lqinlari yengil qatlamlar orqali to’g’ridan-to’g’ri model ongiga kirib boradi. Oddiyroq arxitektura, javob berish vaqtining qisqarishi va uni o’zingizga moslashtirishning (fine-tuning) osonlashgani — uning asosiy yutug’i.
Raqamlarga yuzlansak: 77.2% MMLU Pro, 77.5% AIME 2026, 72.0% LiveCodeBench, 78.8% GPQA Diamond. Google uning 26B MoE modeliga “xotiraning yarmini band qilgan holda” yelma-yelak yetib kelganini aytmoqda. 5-iyunda chiqqan rasmiy QAT (siqilgan) varianti bilan Q4_0 versiyasi endi taxminan 6.7 GB VRAM so’raydi xolos. Uni Multi-Token Prediction (bir vaqtda bir nechta so’zni taxmin qilish) bilan birga ishlatsangiz, RTX 4070 Super kabi 12 GB VRAM’ga ega kartalarda soniyasiga 100–130+ token tezlikda yozadi. U hatto alohida videokartasi yo’q, lekin 16 GB birlashtirilgan xotirasi bor noutbuklarda (masalan, Mac) ham ishlayveradi.
Agar kompyuteringizda mustaqil ishlaydigan AI yordamchilari, maxfiy ovozli yordamchi yoki begonalarga ko’rsatilmaydigan shaxsiy kodlash dasturlari kerak bo’lsa va bulutga bog’lanib qolishni istamasangiz — aynan shu model siz uchun.
26B MoE — Samaradorlik bo’yicha ekspert (kvantlangan 15–18 GB VRAM)
26B modelida jami 26 milliard parametr bor, lekin bu yerda bitta zo’r fokus bor: har bir so’z (token) chiqqanda uning faqat 3.8 milliardi ishga tushadi. Aqlli “marshrutizator” tizimi ichkaridagi 128 ta mutaxassis (ekspert) tarmog’idan har gal eng kerakli 2 tasinigina chaqiradi va kompyuter kuchini tejagan holda deyarli 31B sifatiga erishadi. Tasavvur qiling, sizning ulkan binoda turli mutaxassislaringiz bor va savolga javob berish uchun har safar faqat shu savolga usta bo’lgan ikkitasini ofisga chaqirasiz.
U matn, rasm va videoni ham (kichik modellar kabi faqat ovozni emas) tushunadi, 256K kontekst (uzun xotira) oynasiga ega va Arena AI ochiq reytingida 6-o’rinda turibdi. Buning badali faqat xotira bilan to’lanadi — sizga siqilgan (kvantlangan) 15-18 GB xotira, ya’ni RTX 4090, RTX 5060 Ti 16 GB yoki 32 GB xotirali Mac kerak bo’ladi. Agar kompyuteringiz ko’tarsa va siz elektrni tejab, sifatli natija kutmoqchi bo’lsangiz, bu model qidirganingizdir.
31B Dense — Murosasiz gigant (kvantlangan 16–20 GB VRAM)
Hech qanday marshrutizator, ekspertlar aralashmasi yoki aylanib o’tishlar yo’q. 31B Dense har bir so’z uchun o’zining barcha 30.7 milliard parametrlarini to’liq kuch bilan ishga soladi. Bu Gemma 4 oilasining haqiqiy cho’qqisi bo’lib, barcha ochiq modellar ichida Arena AI da 3-o’rinni egallab turibdi va qiyin matematika testi AIME 2026 da 89.2% olgan. Modallik jihatdan u ham 26B bilan bir xil (matn, rasm, video), bir xil 256K uzun xotira oyna, biroq har bir savolda u barcha aqlini bir joyga yig’ib to’liq chuqur mulohaza yuritadi.
Uning yagona qimmatli tomoni kompyuterning kuchidir. BF16 rejimida bu ulkan “miya” 71 GB VRAM talab qiladi (bu butun boshli biznes-server degani). Biroq uni INT4 darajasigacha siqsangiz, u 16-20 GB xotiraga bemalol joylashadi, shunda uni oddiy odamlar ishlatadigan kuchli kompyuterlarda ham yurgizish mumkin. Agar texnik imkoniyatingiz yetsa va sizga tezlikdan ko’ra javobning xatosiz, sifatli bo’lishi muhimroq bo’lsa, bu yopiq pullik bulutli modellarga tenglasha oladigan ajoyib ochiq yechimdir.
Xo’sh, qaysi birini tanlash kerak?
Mana halol tanlov varaqasi:
- Telefon, oflayn, tezkor mayda vazifalar → E4B (yoki o’ta kuchsiz, eski telefonlar uchun E2B)
- Noutbuk, 8–12 GB videokarta → 12B Unified (QAT versiyasi)
- Noutbuk, 16 GB oddiy xotira (Mac), videokarta yo’q → 12B Unified (QAT versiyasi) (biroz sekinroq ishlaydi, lekin qoyilmaqom eplaydi)
- Ish stansiyasi kompyuter, RTX 4090 / 32 GB Mac → 26B MoE (vattiga eng sifatli natija)
- Server yoki kuchli ish stansiyasi → 31B Dense (maksimal sifat, kompromissiz natija)
Beshala model ham Apache 2.0 litsenziyasiga ega (erkin foydalanish), 140 dan ortiq tillarni qo’llab-quvvatlaydi, shuningdek Ollama, llama.cpp, LM Studio, vLLM kabi dasturlar va Google’ning AI Edge yordamchi to’plamlari bilan bemalol kelishib ishlaydi. Oila a’zolari o’z tuzilishida bir-biriga qo’shilmasligi mumkin, lekin bitta kuchli g’oyada mudom birlashadi: begonalarning bulutida emas, o’z kompyuteringizda siz uchun ishlaydigan haqiqiy jiddiy sun’iy intellekt.