Article

OpenAI präsentiert 'Jalapeño': Erster eigener Inference-Chip mit Broadcom

OpenAI Broadcom Hardware Inference AI-Chips

OpenAI hat seinen ersten selbstentwickelten Inference-Prozessor namens Jalapeño offiziell vorgestellt. Der Chip wurde in Zusammenarbeit mit Broadcom entworfen und speziell für die Anforderungen von LLM-Inferenz-Workloads optimiert.

Schlüsseldaten

  • Hersteller: OpenAI in Kooperation mit Broadcom
  • Fokus: Reine Inferenz (nicht Training)
  • Performance: Signifikant bessere Performance-per-Watt als aktuelle Alternativen
  • Besonderheit: OpenAI’s eigene KI-Modelle unterstützten bei der Chip-Entwicklung

Der Chip zielt darauf ab, OpenAI’s Abhängigkeit von Nvidia-GPUs zu reduzieren – ein Schritt, den bereits Google und Amazon mit ihren eigenen AI-Beschleunigern gegangen sind. Während trainingsintensive Aufgaben weiterhin auf Nvidia-Hardware laufen werden, können bereits kleine Verbesserungen bei Inference-Kosten die Ökonomie von AI-Services massiv beeinflussen.

OpenAI-Präsident Greg Brockman betonte: “Wir haben ein tiefes Verständnis der Workloads und haben nach Bereichen gesucht, die unterversorgt sind – wie können wir etwas bauen, das beschleunigt, was möglich ist?”

Die Chip-Entwicklung ist Teil von OpenAI’s vertikaler Integrationsstrategie: Das Unternehmen entwickelt nicht nur Frontier-Modelle und Produkte darauf, sondern gestaltet nun auch die darunterliegende Infrastruktur – Chip-Architektur, Kernel, Speichersysteme, Netzwerke und Deployment-Systeme.

Quelle: TechCrunch