Drei Ankündigungen auf der Cisco Live 2026, die das nächste Kapitel für Qumulo und Cisco einläuten
In fast jedem Gespräch, das ich mit unseren Kunden führe, dominieren mittlerweile drei Themen die Tagesordnung. Ransomware ist zu einem Problem auf Vorstandsebene geworden, das sich nicht allein durch Endgeräteschutz und Datenwiederherstellung lösen lässt. Die Flash- und Speichermärkte wurden durch den Ausbau der KI-Infrastruktur der Hyperscaler strukturell umgestaltet, was die Preise für Komponenten um bis zu 400 Prozent in die Höhe getrieben und die Beschaffungsvorlaufzeiten auf über sechs Monate verlängert hat. Und das zentrale wirtschaftliche Problem bei KI in Unternehmen ist nicht mehr die Beschaffung von GPUs. Es ist vielmehr die Tatsache, dass riesige Mengen bereits bereitgestellter GPUs ungenutzt herumliegen und darauf warten, dass Daten eintreffen.
Das sind keine drei getrennten Geschichten. Es sind drei Facetten desselben Marktwandels. Der Schwerpunkt im Bereich der Unternehmens-IT hat sich auf die Daten selbst verlagert. Die Infrastruktur, die das nächste Jahrzehnt prägen wird, wird Daten als lebendiges, verteiltes und intelligentes Kapital betrachten und nicht als Bestandsgut, das hinter einem Array geparkt ist.
Diese Überzeugung ist der Grund, warum Qumulo diese Woche auf der Cisco Live in Las Vegas mit drei Ankündigungen vertreten ist, die in ihrer Gesamtheit verdeutlichen, in welche Richtung sich die Partnerschaft zwischen unseren beiden Unternehmen entwickelt. Jede einzelne davon ist für sich genommen bereits von Bedeutung. Zusammen bilden sie eine abgestimmte Antwort auf die drängendsten Probleme der heutigen Unternehmensinfrastruktur.
Ransomware dort stoppen, wo sie tatsächlich zuschlägt
Die erste Ankündigung betrifft Qumulo NeuralProtect. Seit zwei Jahrzehnten stützt sich die Sicherheitsbranche bei ihrer Ransomware-Strategie auf zwei Säulen: die Erkennung an Endgeräten und die Wiederherstellung aus Backups. Beides ist notwendig. Beides allein reicht jedoch nicht aus. Bis ein Signal vom Endgerät eintrifft oder ein Backup wiederhergestellt ist, hat der Angreifer bereits Stunden oder Tage Zeit gehabt, um Live-Produktionsdaten zu verschlüsseln.
NeuralProtect überprüft jede Datei zum Zeitpunkt des Schreibvorgangs. Das Programm kombiniert eine deterministische Engine für bekannte Malware-Varianten, eine statistische Engine für Zero-Day-Angriffe und eine zeitbasierte Engine für langsame, partielle Verschlüsselungskampagnen, die heute routinemäßig die auf Entropie basierende Erkennung umgehen. Das Ergebnis ist eine Echtzeit-Prävention auf Speicherebene mit einer Falsch-Positiv-Rate von unter einem von zehntausend.
Was dies jedoch strategisch so wichtig macht, ist das Zusammenspiel von NeuralProtect mit Cisco Hypershield und Splunk. Die Speicherintelligenz liefert Informationen für die Netzwerkdurchsetzung, und die Netzwerktelemetrie fließt über OpenTelemetry zurück in den Workflow des Security Operations Center. Die kompromittierte Sitzung wird beendet, der Host unter Quarantäne gestellt, ein defensiver Snapshot erstellt, und das Sicherheitsteam erhält die forensischen Informationen, um innerhalb von Sekunden statt Stunden reagieren zu können. Das ist keine Funktion. Das ist eine Architektur – und genau diese Architektur fordern unsere Kunden seit fast einem Jahrzehnt von der Branche.
Eine Brücke zur Cloud statt einer erzwungenen Migration
Die zweite Ankündigung ist eine direkte Reaktion auf die von mir eingangs beschriebene Preisentwicklung bei den Komponenten. Unternehmen, die ihre All-Flash-Arrays erneuern möchten, sehen sich mit Preisen und Lieferzeiten konfrontiert, die sich einfach nicht rechnen. Die von traditionellen Speicheranbietern angebotene Alternative – verlängerte Supportverträge, deren Kosten für ein einziges zusätzliches Jahr 150 Prozent des ursprünglichen Systempreises übersteigen können – ist keine Strategie. Es ist eine Abgabe für Kunden, die zwischen zwei Märkten gefangen sind.
Das cloudnative Qumulo Enterprise auf dem Cisco Unified Computing System, das über die Qumulo Cloud Data Fabric verbunden ist, bietet unseren Kunden einen alternativen Weg. Workloads lassen sich nahtlos auf AWS, Azure, Google Cloud oder Oracle Cloud Infrastructure ausweiten – ohne Neugestaltung der Anwendungen, ohne störende Migrationszeitpläne und ohne Abstriche bei der bereits funktionierenden On-Premises-Infrastruktur. Benutzer und Anwendungen bemerken nicht einmal, dass der Cluster erweitert wurde. Der gesamte Datensatz steht überall dort zur Verfügung, wo er benötigt wird, und unser NeuralCache sowie die Cisco-Netzwerktechnologie sorgen dafür, dass die Leistung nicht von der lokalen Leistung zu unterscheiden ist.
Ich möchte die Philosophie hinter diesem Konzept klarstellen. Wir verlangen von unseren Kunden nicht, dass sie ihre bestehenden Systeme komplett ausmustern und durch neue ersetzen. Wir bieten ihnen eine Brücke, und diese Brücke führt in beide Richtungen. Workloads können ausgelagert werden und auch wieder zurückkehren. Genau diese Flexibilität brauchen Führungskräfte in Unternehmen, wenn der Beschaffungszyklus unvorhersehbar geworden ist, die Technologie-Roadmap jedoch nicht.
GPU-Liquidität und das Ende der Datengravitation
Die dritte Ankündigung, der „Qumulo Cloud AI Accelerator“, befasst sich mit dem, was meiner Meinung nach als das entscheidende Infrastrukturproblem dieses KI-Zyklus in die Geschichte eingehen wird. Seit zwei Jahren diskutiert die Branche über die Knappheit an GPUs. Das eigentliche Problem ist jedoch die ungenutzte GPU-Kapazität. Der Bericht „Cast AI 2026 State of Kubernetes Optimization“ beziffert die durchschnittliche GPU-Auslastung in Unternehmen auf fünf Prozent. Die Ursache liegt nicht in der Rechenleistung. Die Ursache ist die „Data Gravity“. Datensätze müssen vor Beginn jeglicher Arbeit bereitgestellt, repliziert und in dieselbe Region sowie denselben Cluster wie die Beschleuniger verschoben werden – und der teure GPU-Zähler läuft die ganze Zeit.
Der Cloud AI Accelerator kehrt dieses Modell um. Durch die Kombination von Cloud Native Qumulo, Cloud Data Fabric und NeuralCache stellen wir jeden Unternehmensdatensatz jeder GPU-Farm in jeder Cloud in Echtzeit zur Verfügung – ohne Kopieren, ohne Zwischenablage und ohne Abstriche bei der Konsistenz. Wir integrieren uns ohne Kopiervorgänge in Microsoft AI Foundry, AWS Bedrock und Google Vertex AI. Cisco UCS und Cisco-Netzwerktechnologie bilden die Rechen- und Konnektivitätsgrundlage, die den Betrieb der Architektur im Unternehmensmaßstab ermöglicht.
Das wirtschaftliche Konzept, das wir mit dieser Markteinführung einführen, ist die GPU-Liquidität. Sobald in einer neuen Region GPU-Kapazitäten verfügbar werden, können unsere Kunden diese innerhalb von Minuten statt Wochen nutzen. Die Beschaffung von GPUs wird damit zu einer Planungsentscheidung und nicht mehr zu einem Logistikprojekt. Das ist ein grundlegend anderes Betriebsmodell für Unternehmens-KI, und die wirtschaftlichen Gegebenheiten dieses Marktes erfordern dies mittlerweile.
Was das für unsere Kunden bedeutet
Ich bin schon lange genug in dieser Branche tätig, um zu erkennen, wann eine Reihe von Ankündigungen wirklich miteinander verbunden ist und nicht nur zeitlich zusammenfällt. Diese drei sind miteinander verbunden: Geschützte Daten an der Quelle. Eine Brücke, die Workloads in die Cloud verlagert, ohne den Geschäftsbetrieb zu stören. Echtzeit-Zugriff auf diese Daten von jeder GPU in jeder Cloud aus. Der rote Faden, der sich durch alle drei zieht, ist derselbe, der auch unsere Partnerschaft mit Cisco prägt. Unsere Kunden verdienen eine Infrastruktur, die ihnen Flexibilität bietet, ohne dass sie Kompromisse bei Sicherheit, Leistung oder Betriebskontinuität eingehen müssen.
Ich bin stolz auf die Arbeit, die unser Team gemeinsam mit dem Team von Cisco geleistet hat, um diese Architektur auf den Markt zu bringen. Noch stolzer bin ich auf die Kunden, die uns dazu motiviert haben, sie zu entwickeln. Sie haben uns ihre Anforderungen mitgeteilt, und wir haben ihnen zugehört. Die Zukunft der Unternehmensinfrastruktur wird von Unternehmen geprägt sein, die drei Dinge gleichzeitig leisten können: Sicherheit, die in die Datenschicht integriert ist; hybride Betriebsmodelle, die mit dem Tempo des Geschäfts Schritt halten; und eine KI-Infrastruktur, die Rechenknappheit in Rechenliquidität verwandelt.
Jede Art von Daten. Jeder Ort. Vollständige Kontrolle. Das ist unser Versprechen. Diese Woche in Las Vegas machen wir es wahr.