Teknoloji

AMD’nin EPYC Venice’i 2nm’de ilk sunucu çipi — 256 çekirdek ve 1,6 TB/sn bellek bant genişliği

Susan Hill

Yarı iletken endüstrisi 22 Temmuz’da bir eşiği daha geçti. AMD, Advancing AI 2026 etkinliğinde EPYC Venice’in — Zen 6 mimarisi üzerine inşa edilen altıncı nesil sunucu işlemci ailesinin — TSMC’nin 2nm üretim sürecinde seri üretime girdiğini duyurdu. Daha önce hiçbir yüksek performanslı bilgi işlem çipi 2nm’de üretilmedi. Venice bu alanda bir ilk.

Amiral gemisi konfigürasyonu, her biri 32 Zen 6 çekirdeği barındıran sekiz Çekirdek Kompleksi Kalıbı (CCD) üzerinde 256 çekirdek ve 512 iş parçacığı sunuyor — bu, önceki CCD tasarımına kıyasla %33’lük bir çekirdek yoğunluğu artışı anlamına geliyor. Platform, 16 bellek kanalına sahip yeni SP7 soketini tanıtarak toplam bant genişliğini 1.6 TB/s’ye çıkarıyor; bu, önceki Turin neslinin 614 GB/s değerinin neredeyse üç katı. 64 Gbps hızındaki PCIe Gen 6 ve beşinci nesil Infinity Fabric, bağlantı yığınını tamamlıyor.

TSMC’nin 2nm düğümü, FinFET’ten GAA (gate-all-around) nanosheet transistörlere geçiş yapıyor — bu yapısal değişiklikle TSMC, aynı güç tüketiminde %10-15 daha yüksek performans veya eşdeğer performansta %25-30 daha düşük güç tüketimi ve %15 daha fazla transistör yoğunluğu vaat ediyor. AMD’nin kendi kıyaslama iddiası ise Turin’in Zen 5 çekirdeklerine kıyasla %70 CPU işlem hacmi artışı. Yapay zeka çıkarım iş yüklerinde AMD, 256 çekirdekli kademede NVIDIA‘nın rakibi Vera platformuna kıyasla 2.2 kat daha fazla işlem hacmi sunduğunu iddia ediyor.

Venice dört ürün hattında sunuluyor. Amiral gemisi EPYC 9006 SP7, 5 GHz turbo frekansı ve 128 PCIe Gen6 hattına sahip 256 çekirdekli Agentic AI modeli. EPYC 9006X SP7 ise maksimum 96 çekirdekte kalıyor ancak 5.15 GHz hızında çalışıyor ve çekirdek başına üç kat daha fazla L3 önbellek sunuyor — gecikmenin ham paralellikten daha önemli olduğu HPC ve simülasyon iş yüklerini hedefliyor. SP8 hattı, 8 ila 128 çekirdek arasında değişen seçeneklerle uç ve güç kısıtlı dağıtımları kapsıyor. Dördüncü bir SKU olan EPYC 9006 LP Verano, raf ölçekli yapay zeka kasaları için LPDDR5X bellek ve 112 Gbps CPU-GPU bant genişliği sunuyor.

Amiral gemisi SKU’daki toplam L3 önbellek, 1.152 MB 3D V-Cache’ye ulaşıyor — bu rakam, DRAM’e dönmek yerine kalıp üzerinde tutulabilen yapay zeka model katmanları için önem kazanıyor. AMD, herhangi bir Venice varyantının fiyatını açıklamadı. Bulut sağlayıcıları ve OEM’lerin bağımsız olarak kullanılabilirlik pencerelerini duyurması bekleniyor; birkaç büyük hiper ölçekleyicinin halihazırda erken müşteriler olarak doğrulandığı belirtiliyor.

Rekabet bağlamı önemli. Intel’in bir sonraki Granite Rapids-D nesli hâlâ Intel 18A üzerinde ve bu ürünün gerektirdiği ölçekte hacimsel verim elde etmeye aylar var. NVIDIA’nın Vera ve Grace ile kendi CPU silikonuna yönelmesi, GPU satıcısını artık CPU soketinde doğrudan bir rakip haline getiriyor. Venice, her iki alternatifin de karşılaştırılabilir üretim ölçeğine ulaşmasından önce piyasaya çıkıyor; bu da tarihsel olarak 12 ila 18 ay ilerideki bulut tedarik döngülerinde kazanma oranlarına dönüşüyor.

Yapay zeka iş yükü operatörleri için bellek bant genişliği rakamı en doğrudan anlamlı olanı. Ölçekte eğitim ve çıkarım, öncelikle bant genişliğiyle sınırlanan işlemlerdir ve raf düğümü başına etkili bant genişliğini ikiye katlamak, token başına maliyet matematiğini ölçülebilir bir şekilde değiştirir. CPU darboğazlarını telafi etmek için büyük GPU rezervasyonları tutan bulut operatörleri artık alternatif bir yola sahip. Bu aritmetik, önümüzdeki iki tedarik sezonunda kendiliğinden netleşecek.

Etiketler: , , , , ,

Tartışma

S kadar yorum var.