Ana içeriğe geç
Donanım

d-Matrix Hot Chips 2026'da Raptor 3D-DRAM çıkarım hızlandırıcısını tanıttı

Öne çıkanlar

  • Raptor, TSMC N4 mantık katmanını 36 mikrometre bağlantıyla 3D DRAM üzerine yerleştiriyor.
  • Düşey bağlantılar, HBM çözümlerine kıyasla bit başına enerji tüketimini yaklaşık 10 kat düşürüyor.
  • Milimetrekare başına 32,6 GB/s bant genişliği sağlayan sistem, HBM4'e göre 20 kat yoğunluk sunuyor.

Yapay zeka çipi üreticisi d-Matrix, Hot Chips 2026 etkinliğinde üretken yapay zeka çıkarımı için tasarladığı Raptor 3D-DRAM hızlandırıcısını duyurdu. Şirket, büyük dil modellerinde bellek darboğazı oluşturan anahtar-değer önbelleği ve kod çözme aşamalarını aşmak için hesaplama mantığını doğrudan bellek yongalarının üzerine yerleştiriyor. Yeni tasarım, HBM tabanlı mimarilerin karşılaştığı yüksek enerji tüketimi ve bant genişliği sınırlarına bir alternatif sunuyor.

Raptor mimarisinde TSMC N4 mantık yongası, 36 mikrometre yüz yüze bağlantıyla 3D DRAM yongasının üzerine istifleniyor. Düşey bağlantı arayüzü sayesinde veri iletiminde bit başına enerji tüketimi 0,3 ila 0,4 pikojoule seviyesine iniyor ve bu değer HBM çözümlerine kıyasla yaklaşık 10 kat tasarruf sağlıyor. Şirket, bellek erişimindeki artık veri aktarımını sıfıra indirmek ve termal güvenilirliği korumak için özel akış engelleme ve veri yolu ters çevirme teknikleri kullanıyor.

Sıvı soğutmayla desteklenen mimari, 105 dereceye varan bağlantı sıcaklıklarında dahi bant genişliği kaybını yüzde 1,4 seviyesinin altında tutmayı hedefliyor. d-Matrix verilerine göre sistem, milimetrekare başına 32,6 GB/s bant genişliği sunarak HBM4 tabanlı alternatiflere kıyasla yaklaşık 20 kat yoğunluk avantajı vadediyor. Şirket, kart başına 32 GB kapasiteye sahip 72 kartlık bir kümenin 1 milyon bağlam uzunluğundaki gelişmiş modelleri çalıştırabileceğini belirtiyor.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.