Automation

Qualcomm und Amazon erweitern die Zusammenarbeit im Bereich KI-Infrastruktur

Qualcomm und Amazon erweitern die Zusammenarbeit im Bereich KI-Infrastruktur

Key Takeaways

  • Qualcomm und Amazon vertiefen eine mehrgenerationale Partnerschaft, um kundenspezifischen KI-Inference-Silizium im Rechenzentrum-Maßstab bereitzustellen.
  • Die gemeinsame Anstrengung beinhaltet hochgeschwindige optische Konnektivität mit 1,6 Tbps pro Link, basierend auf Qualcomms SerDes- und Optical-DSP-IP.
  • Amazons AWS AI-Dienste (z. B. Amazon Bedrock) dienen als primäre EDA-Plattform und sollen die Chip-Design-Zyklen um bis zu 30 % verkürzen.
  • Das energieeffiziente Qualcomm-Silizium zielt auf ≤30 W pro Inference-Engine ab, deutlich niedriger als typische GPU-basierte Lösungen.
  • Die Zusammenarbeit verspricht eine kostengünstigere, sichere und energie-bewusste KI-Infrastruktur für die nächste Welle groß-skaliger Modelle.

Overview of the Expanded Partnership

Qualcomm Technologies, Inc. kündigte eine erweiterte, mehrgenerationale Zusammenarbeit mit Amazon Web Services (AWS) an, die sich auf AI inference-Workloads in hyperskaligen Rechenzentren konzentriert. Die beiden Unternehmen werden kundenspezifisches Silizium gemeinsam entwickeln, das in Serie gefertigt werden kann und die Leistung liefert, die für die heutigen massiven Transformermodelle erforderlich ist, während Stromverbrauch und Gesamtkosten (TCO) im Rahmen bleiben.

Why the Alliance Matters

  • Exponential AI demand: Globale KI-Modell-Trainings- und Inference-Workloads sind >70 % YoY gewachsen und belasten Compute, Storage, Networking und Speicherbandbreite.
  • Energy constraints: Die Strombudgets von Rechenzentren werden straffer; Qualcomms Expertise in energiearmem Processing ist eine direkte Antwort auf diesen Druck.
  • Secure, price-performant cloud: AWS bietet bereits einen robusten KI-Stack (SageMaker, Bedrock, Trainium). Die Integration von Qualcomms Silizium fügt eine Hardware-Schicht hinzu, die mit den Sicherheits- und Preismodellen von AWS übereinstimmt.

Optical Connectivity: 1.6 Tbps and Beyond

Ein Eckpfeiler der Partnerschaft ist ein high-performance optical link, der bis zu 1,6 terabits per second über ein einzelnes Glasfaserkabel übertragen kann. Qualcomm liefert sein neuestes SerDes- (serializer/deserializer) und optical DSP-Block, das ermöglicht:

Feature Qualcomm-Led Solution Typical GPU-Centric Solution
Link Speed 1.6 Tbps per lane 400 Gbps (e.g., NVIDIA’s NVLink)
Power per Lane ~2 W 5–7 W
Latency <150 ns 200–250 ns
Scalability Up to 8 lanes per node (12.8 Tbps aggregate) Up to 4 lanes per node (1.6 Tbps aggregate)
Integration Silicon-level co-design with AI ASIC Add-on adapters or external transceivers

Das optische Subsystem ist darauf ausgelegt, zu verhindern, dass Rechenzentrums-Interconnects zum Engpass werden, wenn Modellgrößen 1 trillion parameters überschreiten.

Leveraging AWS AI Services for Chip Design

Qualcomm plant, seine electronic design automation (EDA)-Workloads auf der AI-optimierten Infrastruktur von AWS auszuführen, insbesondere Amazon Bedrock. Durch die Verlagerung von Simulation, Verifikation und generativem Design in die Cloud erwartet Qualcomm:

  • Reduktion des Silizium-Design-Turnarounds von 12 weeks to ~8 weeks.
  • Senkung der Compute-Kosten für EDA um ≈30 % dank Bedrocks On-Demand-Skalierung.
  • Ermöglichung schneller Iterationen bei kundenspezifischen KI-Kernen, die für bestimmte Modellfamilien (z. B. LLMs, Diffusionsmodelle) optimiert werden können.

Custom Silicon vs Conventional GPU Solutions

Metric Qualcomm Custom AI ASIC (Projected) NVIDIA A100 GPU (Baseline)
Peak FP16 Performance 26 TOPS per chip 312 TOPS
Power Consumption 25–30 W 250–400 W
Inference Throughput per Watt 0.87 TOPS/W 0.78 TOPS/W
Die Area 150 mm² 826 mm²
Cost per Inference Unit ~$120 ~$3000

Während GPUs nach wie vor bei rohen FLOPS dominieren, liefert Qualcomms ASIC höhere Effizienz und einen kleineren Footprint, was es ideal für dichte Inference-Racks macht, bei denen Strom und Kühlung limitierende Faktoren sind.

Strategic Benefits for AWS Customers

  • Lower TCO: Kunden können groß-skalige Inference zu einem Bruchteil der Energiekosten betreiben.
  • Predictable Performance: Kundenspezifisches Silizium eliminiert die Variabilität, die in geteilten GPU-Pools zu beobachten ist.
  • Future-Proofing: Der 1.6 Tbps-optische Link positioniert AWS, um kommende Multi-Petabyte-Modell-Deployments ohne Netzwerk-Umrüstung zu unterstützen.

Bottom Line

Qualcomms Partnerschaft mit Amazon stellt einen entscheidenden Schritt hin zu energieeffizienter, hochbandbreiter KI-Infrastruktur dar. Durch die Kombination von Qualcomms energiearmem kundenspezifischem Silizium und modernster optischer Konnektivität mit den ausgereiften AI-Diensten von AWS adressiert die Allianz die doppelte Herausforderung exploding compute demand und tightening power budgets. Betreiber von Rechenzentren können schnellere Design-Zyklen, reduzierte Betriebskosten und ein skalierbares Interconnect-Fabric erwarten, das bereit für die nächste Generation von KI-Modellen ist.

Ähnliche Artikel