
Yapay zekâ çıkarım (inference) hızında dünya rekorlarını elinde tutan çip girişimi Groq ve küresel enerji devi Saudi Aramco’nun teknoloji kolu Aramco Digital; Suudi Arabistan’ın başkenti Riyad’da dünyanın en büyük özel yapay zekâ çıkarım merkezini inşa etmek için 1,5 milyar dolarlık stratejik altyapı yatırımını resmen hayata geçirdi. Suudi Arabistan’ın Vision 2030 dijital dönüşüm vizyonunun kalbinde yer alan mega tesis; Ortadoğu, Afrika ve Avrupa’daki yüz milyonlarca kullanıcıya milisaniyelik yanıt hızlarında “Hizmet Olarak Yapay Zekâ” (AI-as-a-Service) sunacak.
Geleneksel Nvidia GPU’larının aksine yalnızca büyük dil modellerinin çalıştırılmasına (çıkarım) odaklanan özel LPU (Language Processing Unit) yongalarıyla donatılan merkez; açık kaynaklı modellerde saniyede 800 tokenin üzerinde deterministik hız sunuyor.
Neden LPU? GPU Tekeline Karşı Deterministik Hız
Nvidia GPU’ları model eğitimi için mükemmel olsa da, anlık konuşma ve ajan işlemlerinde yüksek gecikme (latency) ve bellek darboğazı yaşayabiliyor.
Groq LPU mimarisinin getirdiği 3 teknolojik üstünlük:
- Dahili SRAM Bellek Mimarisi: Pahalı ve yavaş HBM bellekler yerine doğrudan çip üzerine gömülü 230 MB’lık ultra hızlı SRAM kullanır. Bu sayede bellek transfer gecikmesi sıfıra iner.
- Deterministik İşlem Garantisi: Her bir kelimenin tam olarak kaç nanosaniyede üretileceği önceden matematiksel olarak bellidir; sunucu yoğunluğunda gecikme dalgalanması yaşanmaz.
- Nvidia ile Tamamlayıcı İş Modeli: Şirketler modellerini Nvidia GPU kümelerinde eğitirken, canlı kullanıcılara sunum aşamasında (inference) Groq LPU sunucularını kullanarak elektrik faturasını 5 kat düşürür.
Küresel Neocloud Ağı ve Ortadoğu’nun Liderliği
Groq CEO’su Jonathan Ross, yatırımın ardından yaptığı açıklamada; “Yapay zekâda asıl pazar eğitim değil, milyarlarca insanın her gün yapacağı trilyonlarca çıkarım sorgusudur. Riyad merkezimiz dünyanın en hızlı dijital zekâ boru hattı olacaktır” dedi.
Aramco’nun zengin yenilenebilir güneş enerjisi ve gaz türbinleriyle beslenen tesis, veri merkezinin karbon ayak izini minimumda tutarak yeşil hesaplama standartlarını yakalıyor.
| Kriter | Standart GPU Çıkarım Kümesi (H100) | Groq LPU Çıkarım Mimarisi |
|---|---|---|
| Token Üretim Hızı | ~80 - 150 Token/Saniye | 800+ Token/Saniye (Gerçek Zamanlı) |
| Bellek Türü | Harici HBM3e Bellek | Çip İçi Ultra Hızlı SRAM |
| Gecikme Davranışı | Değişken (Kuyruk Gecikmesi Var) | Deterministik (Sıfır Gecikme Dalgalanması) |
| Enerji Verimliliği | Yüksek Isı ve Güç Tüketimi | Çıkarım Başına %80 Daha Düşük Güç |
Kısa Özet
- 1.5 Milyar Dolarlık Yatırım: Groq ve Aramco Digital, Suudi Arabistan’da mega çıkarım merkezi kuruyor.
- 800+ Token/Saniye: LPU çipleri sayesinde modeller konuşma hızından 10 kat hızlı çalışıyor.
- SRAM Bellek Zaferi: Çip içi gömülü bellek ile HBM bağımlılığı ve gecikme kırıldı.
- Bölgesel Zekâ Üssü: Vision 2030 kapsamında Ortadoğu ve Avrupa’ya AI-as-a-Service dağıtılacak.
Sonuç
Groq ve Aramco ortaklığı, küresel yapay zekâ mimarisinin GPU merkezli model eğitiminden, LPU merkezli ultra hızlı ve ekonomik çıkarım merkezlerine doğru kaydığını tescilliyor. Riyad’daki bu mega üs, küresel yapay zekâ trafiğinin yeni kavşak noktasıdır.
Sık sorulan sorular
Groq LPU nedir ve GPU'dan nasıl ayrılır?
Gömülü SRAM bellek kullanan ve yalnızca yapay zekâ çıkarımına odaklanan, harici HBM gecikmesi olmadan deterministik ultra yüksek hız sunan bir işlemcidir.
Riyad merkezinin çıkarım hızı ne kadardır?
Açık kaynaklı büyük dil modellerinde saniyede 800 tokenin üzerinde gerçek zamanlı ve gecikmesiz üretim yapabilmektedir.
Aramco Digital bu ortaklıktan ne kazanıyor?
Vision 2030 kapsamında nawat pazar yeri üzerinden Ortadoğu ve Avrupa'ya yapay zekâ hesaplama gücü (AI-as-a-Service) ihraç etmektedir.
Yatırımın toplam büyüklüğü ne kadardır?
Tesisin inşası, LPU altyapısı ve bölgesel dağıtım ağı için toplam 1.5 milyar dolarlık taahhüt verilmiştir.



