Amazon Web Services (AWS) ve NVIDIA, AI altyapısına yönelik küresel talebin artmasıyla stratejik iş birliğini büyük ölçekte genişletmeyi duyurdu. AWS üzerinde NVIDIA hızlandırmalı hesaplamanın zaten hızlı bir şekilde benimsenmesi üzerine, şirketler 2 milyon ek NVIDIA GPU’sunu AWS’nin küresel altyapısına dağıtmayı ve AI fabrikaları, CPU’lar, ağ, açık modeller, veri işleme ve robotik konularında birlikte çalışmayı derinleştirmeyi planlıyor; müşterilerin AI geliştirme ve dağıtımını benzeri görülmemiş bir ölçekte hızlandıran ortak tasarımlı AI çözümleri sunuyor.

AI iş yükleri, modellerin nasıl eğitildiği ve çalıştırıldığı, verinin nasıl işlendiği, indekslendiği ve akıllı uygulamaları beslemek için nasıl kullanıldığı açısından hızlı bir şekilde ölçekleniyor. Müşteriler pilot aşamadan üretime geçiyor ve iş yüklerini ajan AI, bilimsel keşif, kurumsal otomasyon ve robotik gibi alanlarda ölçeklendiriyor. Daha geniş model seçimi, daha hızlı veri boru hatları ve fiziksel AI gibi yeni kullanım durumları için yeni yetenekler gerekiyor. Ayrıca, altyapının kendi yenilik hızına ayak uydurabilmesi ve görev kritik iş yükleri için en yüksek güvenlik ve güvenilirlik seviyesini koruması gerektiğine dair güven de sağlanmalı.
Bu artan talebi sınır laboratuvarlarından, küresel işletmelere, start-uplara ve hükümetlere karşı karşıya kalmak için AWS ve NVIDIA, 16 yıllık ortak yenilik üzerine AI hesaplama kapasitesini genişletmek ve müşterilere daha hızlı yeni ortak tasarımlı çözümler sunmak için çalışıyor. Genişletilen iş birliğinin bir parçası olarak şirketler şunları yapmayı hedefliyor:
- 2027-2028 yıllarında AWS’nin küresel altyapısına 2 milyon ek NVIDIA GPU dağıtmak
- NVIDIA Vera CPU-tabanlı altyapıyı AWS’ye getirmek
- NVIDIA NVLink Fusion’ı özel NVIDIA yüksek bant genişliğine sahip bellek (NVHBM) ile genişletmek
- ABD hükümeti için AI fabrikaları inşa etmek, federal ve ulusal güvenlik iş yükleri için güvenli AWS altyapısında 100.000 GPU sağlamak
- NVIDIA platformunu AWS Nitro System ve Elastic Fabric Adapter (EFA) ile entegre ederek güvenlik ve güvenilirliği artırmak
- Amazon Bedrock ve Amazon SageMaker’da NVIDIA Nemotron açık modellerini desteklemeye devam ederek müşterilere daha fazla açık model seçeneği sunmak
- NVIDIA cuDF ve cuVS CUDA-X kütüphaneleriyle Amazon EMR ve Amazon OpenSearch’ta veri işleme ve vektör indekslemeyi hızlandırarak daha hızlı, daha maliyet-verimli analiz ve AI uygulamaları sağlamak
- Amazon Robotics’in NVIDIA’nın fiziksel AI platformunu benimsemesiyle robotik iş yüklerini daha da ilerletmek, depo otomasyonu ve nesil-sonrası robotlarda inovasyonu hızlandırmak
AI hesaplama kapasitesinin büyük ölçekli genişlemesi
AWS, AI ve makine öğrenimi iş yüklerinin çeşitliliğini desteklemek için herhangi bir bulut sağlayıcıdan daha geniş bir GPU-tabanlı örnek yelpazesi sunar. NVIDIA GTC 2026’da AWS planlarını duyurdu ve 2026’dan itibaren 1 milyonun üzerindeki NVIDIA GPU’su ekleyecek. O zamandan beri talep bu beklentileri aştı. AWS, 2027-2028 yıllarında AWS Global Infrastructure’da, AI fabrikaları da dahil olmak üzere, ek 2 milyon NVIDIA Blackwell Ultra, Rubin ve Rubin Ultra GPU dağıtmayı planlıyor. Bu ek kapasite, ajan AI ve bilimsel keşiften kurumsal otomasyon ve fiziksel AI’ya kadar müşteri iş yüklerini güçlendirecek. Ayrıca, AWS NVIDIA Blackwell kapasitesini, NVIDIA RTX PRO 4500 Blackwell Server Edition GPU’larını Amazon EC2 G7 örnekleri için genişletecek. G7 örnekleri, önceki nesil G6 örneklerine göre 4.6× AI çıkarım performansı ve 2.1× grafik performansı sunar. AWS, RTX PRO 4500 ile hızlandırılmış örnekler sunan ilk büyük bulut sağlayıcıdır. AWS ve NVIDIA ayrıca, büyük ölçekli AI eğitim iş yükleri için GPU kümelerinde ağ performansını daha da optimize etmek amacıyla NVIDIA Spectrum ağ teknolojisi üzerinde iş birliği yapıyor.
AWS’de NVIDIA Vera CPU’ları desteği
AWS ve NVIDIA, Vera CPU-tabanlı altyapıyı AWS’ye getirmek için çalışıyor; bu, yüksek performanslı CPU hesaplamasıyla birlikte hızlandırılmış altyapı gerektiren ajan AI iş yüklerini desteklemek için ek bir seçenek sunar. Bir sonraki nesil AI için özel olarak tasarlanmış Vera, AWS’nin en geniş hesaplama seçeneği sunma stratejisini tamamlar — AWS özel silikonundan ortakların en yeni hızlandırıcı ve CPU’larına kadar.
NVHBM ile NVIDIA NVLink Fusion kullanan heterojen AI altyapısı
re:Invent 2025’de AWS, bir sonraki nesil Trainium çiplerinde NVIDIA NVLink Fusion yüksek hızlı çip ara bağ teknolojisini desteklediğini duyurdu. NVIDIA ve Amazon’un Annapurna Labs’ı, hafıza tedarikçileriyle ortaklık içinde NVIDIA’nın yeni özel yüksek bant genişliğine sahip bellek (NVHBM) teknolojisini çalıştırmak için bu desteği genişletiyor; bu, Trainium’a daha hızlı ve daha enerji verimli bellek sağlayacak. NVLink Fusion ile birleştiğinde, Annapurna Labs artık NVIDIA’nın özel bellek teknolojisini ve ölçeklenebilir mimarisini kullanarak AI iş yükleri için performans ve verimliliği artırabilir; aynı zamanda Trainium ve GPU’ları ortak bir rack-scale mimaride sorunsuz bir şekilde entegre eder.
Federal AI’yı en yüksek güvenlik seviyelerinde çalıştırma
Hükümet kurumları, ulusal güvenlik taleplerine ayak uydurmak için güvenli AI altyapısına ihtiyaç duyar. AWS ve NVIDIA, ABD hükümeti için AI fabrikaları inşa etmeyi, NVIDIA’nın AI yığınına erişim sağlamayı ve federal ile ulusal güvenlik iş yükleri için AWS’nin güvenli altyapısında 100.000 GPU sunmayı planlıyor. Bu iş birliği, AWS ve NVIDIA’yı federal AI ilerlemesinin merkezine yerleştiriyor; hükümet kurumlarının Impact Level 6 (IL6) ve üzeri sınıflandırılmış iş yükleri için AI’yı ölçekli bir şekilde dağıtmasını sağlıyor.
Bu yeni taahhütler, bugün müşteriler için sonuçlar veren derin teknik entegrasyon temeline dayanıyor, örnek olarak:
- AWS Nitro System ve EFA ile artırılmış güvenlik ve güvenilirlik — Bu genişletilen iş birliği kapsamında, NVLink Fusion kullananlar da dahil olmak üzere tüm NVIDIA GPU-tabanlı ve Trainium-tabanlı EC2 örnekleri AWS Nitro System üzerine inşa ediliyor ve EFA üzerinden birbirine bağlanıyor. Hem GPU-hızlandırmalı hem de Trainium-tabanlı EC2 örnekleri Nitro System üzerine inşa edilmeye ve EFA üzerinden ölçeklendirilmeye devam edecek. Nitro ve EFA, AWS NVIDIA GPU filosunu genişlettikçe ve yeni ara bağ teknolojilerini entegre ettikçe, müşterilerin üretim AI iş yükleri için güvenlik, güvenilirlik ve ağ performansını korumasına yardımcı olur.
- AWS’de NVIDIA Nemotron modelleri — AWS’nin müşterilere en geniş AI model seçimini sunma taahhüdünün bir parçası olarak, NVIDIA’nın Nemotron açık model ailesi Amazon Bedrock’ta tam yönetilen, sunucusuz modeller olarak ve Amazon SageMaker’da kendi altyapılarına dağıtmak ve ince ayar yapmak isteyen müşteriler için sunuluyor. Bu entegrasyon, müşterilere NVIDIA’nın en yeni açık modellerine AWS’nin güvenliği, ölçeklenebilirliği ve operasyonel araçlarıyla erişim sağlıyor.
- GPU-hızlandırmalı veri işleme ve vektör indeksleme — Veri hacmi arttıkça, özellik mühendisliği, büyük ölçekli ETL ve gerçek-zamanlı analiz gibi iş yükleri daha hızlı işleme gerektiriyor. AWS ve NVIDIA, Amazon EMR’de Amazon EC2 G7 örnekleri ve NVIDIA cuDF kütüphanesini kullanarak GPU-hızlandırmalı veri işleme sunuyor; bu, CPU-tabanlı yapılandırmalara göre %30 daha iyi fiyat-performans ve %3.7 daha hızlı işleme sağlıyor. Ayrı olarak, AI uygulamaları, retrieval-augmented generation boru hatları ve anlamsal arama vektör veritabanlarını milyarlarca kayda çıkarırken, indeks oluşturma ve ayarlama bir darboğaz haline geliyor. Amazon OpenSearch Service’te GPU-hızlandırmalı vektör indeksleme, indeks oluşturmayı özel GPU’lara devrediyor; bu, yönetilen kümelerde ve Amazon OpenSearch Serverless’ta %9’a kadar daha hızlı vektör indeksleme ve maliyetin dörtte biriyle sunuluyor.
- Robotik için fiziksel AI — Amazon Robotics, NVIDIA’nın tam yığın fiziksel AI platformunu, NVIDIA Jetson platformunu, NVIDIA Omniverse kütüphanelerini ve NVIDIA Isaac açık robotik geliştirme platformunu entegre eden nesil-sonrası robotların geliştirilmesini hızlandırmak için NVIDIA ile iş birliği yapıyor. İş birliği, simülasyon, sentetik veri üretimi, robot eğitimi, rota optimizasyonu, fonksiyonel güvenlik ve gerçek-sim doğrulama gibi alanları kapsıyor; tümü GPU-hızlandırmalı Amazon EC2 örneklerinde çalışıyor. Birlikte, AWS ve NVIDIA, robotik iş yüklerinin ölçekli gereksinimlerini karşılamak için büyük ölçekli simülasyon, çeşitli eğitim verileri ve sürekli gerçek-dünya doğrulama gibi yetenekleri ilerletiyor.
Daha fazla bilgi için nvidia.com adresini ziyaret edin.
The post AWS and NVIDIA plan to add 2 million GPUs by 2028 appeared first on Engineering.com.