SEATTLE, 26. Mai 2026 — Qumulo, das Unternehmen Accelerated Data, hat heute den „Qumulo Cloud AI Accelerator“ vorgestellt – einen neuen Ansatz für die KI-Infrastruktur in Unternehmen, der verteilte Unternehmensdaten in Echtzeit an GPU-Ressourcen über Regionen, Clouds und Hybridumgebungen hinweg bereitstellt, ohne dass dabei Replikation, Verzögerungen beim Staging oder Kompromisse bei der Datenkonsistenz erforderlich sind.
Laut einer aktuelle Analyse … liegt die durchschnittliche GPU-Auslastung in Unternehmen bei erstaunlichen 5 %. Das bedeutet, dass eine beschleunigte Recheninfrastruktur im Wert von Hunderten von Milliarden Dollar etwa 95 % der Zeit ungenutzt bleibt, da Daten erst bereitgestellt, repliziert und an den richtigen Ort verschoben werden müssen, bevor eine Arbeitslast überhaupt gestartet werden kann. Eine verbesserte Tokenomics muss die gesamte Entstehungszeit berücksichtigen, nicht nur die letzte Etappe.
Anstatt Unternehmen dazu zu zwingen, riesige Datensätze dorthin zu verlagern, wo gerade GPUs verfügbar sind, verfolgt der Qumulo Cloud AI Accelerator einen grundlegend anderen Ansatz. Er beseitigt die Engpässe durch „Data Gravity“ und „Data Staging“, die GPU-Leerlaufzeiten überhaupt erst verursachen, und ermöglicht es Unternehmen so, eine agile KI-Infrastruktur aufzubauen, die sich innerhalb von Minuten an die wechselnde GPU-Verfügbarkeit über Clouds und Regionen hinweg anpasst – und damit echte Unternehmens GPU-Liquidität.
„Jedes Unternehmen, mit dem wir sprechen, konzentriert sich auf die Verfügbarkeit von GPUs, doch die Verfügbarkeit ist nur die halbe Miete. Das tiefer liegende Problem ist die Auslastung, und der Übeltäter ist die Datengravitation“, so Douglas Gourlay von Qumulo. „Die Branche hat darauf reagiert, indem sie Unternehmen enger gekoppelte Speichersysteme verkauft, die direkt an GPU-Cluster angeschlossen sind. Das optimiert zwar einen winzigen Teil der aktiven Rechenzeit, lässt aber die umgebende Leerlaufzeit völlig außer Acht. Dies führt lediglich zu teureren Lizenzen und Speicherinseln, deren Wartung aufwendig ist. Der Cloud AI Accelerator wurde entwickelt, um das eigentliche Problem zu lösen: die Daten sofort zu den GPUs zu bringen, wo auch immer diese sich befinden, ohne sie jemals kopieren zu müssen.“
Der Qumulo Cloud AI Accelerator schafft GPU-Kapazität durch den Aufbau einer intelligenten Data Fabric, die Cloud Native Qumulo (CNQ), Qumulo Cloud Data Fabric und Qumulo NeuralCache in On-Premise-, Edge- und Multi-Cloud-Umgebungen integriert. Dadurch können Unternehmen Workloads dort ausführen, wo GPU-Kapazität verfügbar ist, anstatt dort, wo sich die Daten gerade befinden. Dies verändert Auf der Suche nach einer GPU von einem kostspieligen logistischen Problem zu einem flexiblen Planungsvorgang, bei dem beliebige Unternehmensdatensätze in Echtzeit an jede beliebige GPU-Farm in jeder beliebigen Cloud übermittelt werden.
Mit dem Qumulo Cloud AI Accelerator können Unternehmen:
Verbinden, ohne zu kopieren: Verbinden Sie lokale oder cloudnative Qumulo-Systeme nahtlos und sicher mit Microsoft AI Foundry, AWS Bedrock und Google Vertex AI, ohne Daten zu kopieren.
Globale GPU-Kapazität erfassen: Führen Sie KI-Workloads überall und jederzeit aus, sobald GPU-Kapazitäten verfügbar sind – unabhängig von Region, Cloud oder Verfügbarkeitszone.
Verzögerungen bei der Bereitstellung beseitigen: Beseitigen Sie die wochenlangen Verzögerungen bei der Datenaufbereitung, die dazu führen, dass die GPU-Infrastruktur ungenutzt bleibt, bevor Trainings- oder Inferenz-Workloads beginnen.
Lagerinseln beseitigen: Vermeiden Sie die Einrichtung mehrerer isolierter und doppelter Speichersilos in allen Umgebungen, in denen GPUs zum Einsatz kommen könnten.
Die Kosten für ungenutzte Rechenkapazitäten drastisch senken: Reduzieren Sie die Kosten für ungenutzte GPUs drastisch, indem Sie die Phase der hohen Auslastung beim Auslesen von Daten aus dem an die GPU angeschlossenen Flash-Speicher vermeiden.
Auf Cisco basierende KI-Infrastruktur für Unternehmen
Die Netzwerk-, Sicherheits- und Rechenlösungen von Cisco spielen eine grundlegende Rolle in der Architektur des Cloud AI Accelerator. Das Cisco Unified Computing System (UCS) bietet eine skalierbare KI-Recheninfrastruktur für Unternehmen für On-Premise- und Hybrid-Bereitstellungen, während die leistungsstarken Netzwerktechnologien von Cisco einen sicheren Datentransfer mit geringer Latenz über Hybrid- und Multi-Cloud-KI-Umgebungen hinweg ermöglichen. Gemeinsam ermöglichen Qumulo und Cisco Unternehmen den Aufbau einer agilen KI-Infrastruktur, die sich innerhalb von Minuten an veränderte GPU-Verfügbarkeiten anpasst und so die betriebliche Flexibilität bietet, die GPU-Liquidität im Unternehmensmaßstab realisierbar macht.
Der Qumulo Cloud AI Accelerator ist ab sofort auf AWS, Azure, Google Cloud und Oracle Cloud Infrastructure (OCI) verfügbar und unterstützt hybride Bereitstellungen in lokalen Cisco UCS-Umgebungen.
Weitere Informationen finden Sie unter, Bitte vereinbaren Sie einen Termin mit uns am Qumulo-Stand Nr. 4018 auf der Cisco Live 2026 vom 31. Mai bis 4. Juni in Las Vegas und/oder auf der Qumulo-Website unter www.qumulo.com
Über Qumulo
Qumulo ist der einzige Anbieter, der bereits sieben Mal als „Leader“ im Gartner Magic Quadrant für verteilten Datei- und Objektspeicher ausgezeichnet wurde, und der führende Anbieter von Cloud-Datenplattformen. Mit Exabyte an verwalteten Daten und mehr als 1.000 Kunden im Produktivbetrieb genießen Fortune-500-Unternehmen und globale Konzerne das Vertrauen von Qumulo, wenn es um die Verwaltung, Speicherung, Kuratierung und den Schutz ihrer Daten geht. Damit eröffnet Qumulo neue Möglichkeiten und treibt Innovationen in verschiedenen Branchen voran. Weitere Informationen finden Sie unter www.qumulo.com.
Medienkontakt:
PR@Qumulo.com