OpenAI'ın Jalapeño çipi Nvidia'yı performans testlerinde geride bıraktı

OpenAI, yapay zeka çıkarımı için geliştirdiği Jalapeño çipinin performans sonuçlarını açıkladı. Broadcom işbirliğiyle üretilen çip, Nvidia'nın GB200/GB300 sistemlerine kıyasla watt başına 1,5-1,9 kat daha fazla yapay zeka işi gerçekleştiriyor ve 1,7-3,6 kat daha düşük gecikme sunuyor.

Haberlerimizi Google'da Takip Edin Gelişmelerden anında haberdar olun. Google'da tercih edilen kaynak olarak ekleyin
OpenAI'ın Jalapeño çipi Nvidia'yı performans testlerinde geride bıraktı

OpenAI, yapay zeka modellerinin çıkarım (inference) süreçleri için geliştirdiği Jalapeño adlı özel entegre devrenin (ASIC) ilk performans sonuçlarını açıkladı. Salı günü Hot Chips konferansında sunulan bulgulara göre çip, mevcut Nvidia çözümlerine kıyasla hem enerji verimliliği hem de yanıt hızı açısından önemli bir ilerleme sunuyor.

OpenAI donanımdan sorumlu başkan Richard Ho, Jalapeño'nun "her iki dünyanın en iyisini" birleştirdiğini belirtti. Tipik olarak yapay zeka sistemleri düşük gecikme veya yüksek verimlilik arasında seçim yapmak zorunda kalırken, Jalapeño her ikisini de sağlıyor. SemiAnalysis'in InferenceX benchmark platformunda gerçekleştirilen testlerde Jalapeño, GPT-OSS 120B, DeepSeek R1 ve Kimi K2.5 1T modelleriyle test edildi. Sonuçlara göre çip, watt başına 1,5 ila 1,9 kat daha fazla yapay zeka işi gerçekleştirirken, uçtan uca gecikme tarafında 1,7 ila 3,6 kat daha düşük değerler elde etti.

Tasarımda veri hareketi minimize edildi

Jalapeño'nun temel tasarım felsefesi, çıkarım süreci sırasında bellek ve işlem birimleri arasında gereksiz veri taşımasını azaltmak. Broadcom ile ortaklaşa geliştirilen çip, prefill ve iletişim aşamaları sırasında meydana gelen gecikmeleri minimize etmek için özel olarak tasarlandı. Model durumu ve KV cache'i yerel tutarak gerekli işlem, bellek ve ağ kombinasyonunun her çıkarım aşaması için etkinleştirilmesi sağlanıyor. Çip, TSMC'nin N3P üretim süreciyle yapılıyor ve HBM4 bellek kullanarak paket başına 15,4 TB/s bellek bant genişliği sunuyor.
Hesaplama tarafında Jalapeño, yapay zeka modellerinde yoğun kullanılan matris işlemleri için özel motorlar içeriyor. MXFP adlı düşük hassasiyetli sayısal format desteği sayesinde veriler 4 bit seviyesine kadar sıkıştırılabiliyor. Çip ayrıca kontrol işlemleri için 64 bit skaler çekirdekler ve daha yüksek hassasiyet gerektiren hesaplamalar için FP32/INT32 vektör çekirdekleri barındırıyor.

Çok yıllı dağıtım planı

OpenAI, Jalapeño'yu çok nesilden oluşan bir platform olarak konumlandırıyor. Çip, 2026 sonunda küçük hacimlerle devreye alınacak, ancak 2027'den itibaren daha geniş çaplı dağıtım başlayacak. Ho, şirketin Jalapeño ile tüm çip yığınını değiştirmeyi planlamadığını, Nvidia gibi güçlü ortaklarla birlikte çalışmaya devam edeceğini ifade etti. OpenAI, Jalapeño'nun ikinci ve üçüncü nesillerini geliştirmeye hazırlanıyor. OpenAI, Gluon kernel programlama dili aracılığıyla donanım ve yazılımı entegre bir şekilde optimize etmeyi hedefliyor.