KI-gestützte Geschwindigkeit zum Preis eines Objektspeichers
Leistung auf NVMe-Niveau zu den Kosten eines Objektspeichers. Qumulo NeuralCache nutzt vorausschauendes Caching auf Basis von maschinellem Lernen, um einen schnellen Datenzugriff mit geringer Latenz zu ermöglichen und gleichzeitig die Kosten für Cloud-APIs um bis zu 99 % zu senken.
Qumulo NeuralCache beseitigt Bandbreiten- und Entfernungsbeschränkungen – dadurch werden Abläufe beschleunigt, die weltweite Zusammenarbeit vereinfacht und gleichzeitig die Cloud-Kosten gesenkt.
Präemptives Caching
Prognostiziert Daten und speichert sie im Cache, bevor sie benötigt werden, um Latenzzeiten zu vermeiden.
Inferenzgenauigkeit
Liefert äußerst genaue Vorhersagen, indem es Zugriffsmuster aus der Praxis lernt.
Geringere Gesamtbetriebskosten
Vermeiden Sie Replikation in den meisten Workflows und senken Sie die API-Gebühren in der Cloud um 95 % oder mehr.
Fernzugriff, lokale Leistung
Lesen, ändern und nutzen Sie Remote-Daten mit einer Latenz im NVMe-Bereich.
Senkung der Kosten für KI-GPUs
Sorgt für eine vollständige Auslastung der GPUs, indem die Wartezeiten bei der Datenübertragung minimiert werden.
Mehr Daten, weniger Rechenzentrum
Reduziert den Platzbedarf der Hardware und den Energieverbrauch durch intelligenteren Datenzugriff.
Erleben Sie die Zukunft intelligenter Datenleistung.
Machen Sie mit Qumulo NeuralCache Ihren Objektspeicher zu einer leistungsstarken Grundlage für Ihre wichtigsten Workloads.
Wichtige Alleinstellungsmerkmale und Kundennutzen
Herkömmliche Caching-Systeme basieren auf MRU- (Most Recently Used) oder LRU- (Least Recently Used) Heuristiken, die mit komplexen, nichtlinearen Workloads in den Bereichen KI, Analytik und Medien nicht Schritt halten können. NeuralCache wurde anhand von Telemetriedaten aus über 32 Billionen realer Dateitransaktionen trainiert. Es nutzt einen „digitalen Zwilling“, um Ihre Zugriffsmuster vorherzusagen, und lädt genau die Datenblöcke, die Sie benötigen, vorab in den lokalen DRAM oder NVMe, noch bevor Ihre Anwendungen sie anfordern. Diese proaktive Intelligenz erzielt durchweg Cache-Trefferquoten von über 96 %.
Holen Sie sich den ultimativen Cheat-Code für Cloud-Speicher. NeuralCache bietet lokale NVMe-Leistung im Sub-Millisekunden-Bereich für Ihre anspruchsvollsten aktiven Workloads, während Ihre persistenten Daten sicher auf einem äußerst langlebigen und kostengünstigen Objektspeicher abgelegt sind. Sie müssen nicht länger für teure All-Flash-Kapazitäten bezahlen, nur um Spitzenleistung zu erzielen.
Die Rechnungen für Cloud-Speicher werden häufig durch versteckte GET- und PUT-Transaktionsgebühren in die Höhe getrieben. Indem NeuralCache den Großteil der Lesevorgänge lokal abwickelt und Schreibvorgänge vor der Speicherung im Objektspeicher intelligent aggregiert, verdichtet und komprimiert, kann es die hohen Kosten für Cloud-APIs um bis zu 99 % senken. Dadurch werden schwankende API-Transaktionsgebühren zu einem vorhersehbaren Rundungsfehler.
Verschwenden Sie keine IT-Ressourcen mehr für die Verwaltung Ihrer Speicherleistung. NeuralCache arbeitet vollautomatisch und passt sich dynamisch an. Wenn eine Anwendung ihre Leserichtung ändert, die Parallelität anpasst oder zu anderen Dateien wechselt, passt sich das System sofort an – eine manuelle Cache-Dimensionierung, das „Data Pinning“ oder eine workflowspezifische Optimierung sind nicht erforderlich.
Indem NeuralCache nur die spezifischen Datenbereiche vorhersagt und abruft, die Ihre Anwendungen benötigen – anstatt ganze umfangreiche Dateien zu übertragen –, reduziert es den unnötigen WAN-Datenverkehr und die Auslandsgebühren für global verteilte Teams um mehr als 30 %.
Eine Plattform. Ein Partner. Experten stehen bereit.
Keine Warteschlangen bei Supportanfragen. Rund um die Uhr Zugang zu Technikern, die sich mit KI-gestütztem Datenzugriff, Caching und groß angelegter Dateninfrastruktur auskennen. Echte Menschen. Echte Antworten. Auf Leistung in großem Maßstab ausgelegt.
Weitere Ressourcen
Blog
Effizientere Cloud-Kosten mit CNQ auf Azure Blob Smart Tier
Moderne Unternehmen stehen unter ständigem Druck, unstrukturierte Daten zu skalieren und gleichzeitig die Cloud-Kosten überschaubar zu halten.
Blog
Wenn Flash zum Engpass wird: Warum die NVMe-Knappheit die Speicherstrategie von Unternehmen neu definiert
In den vergangenen achtzehn Monaten sahen sich Einkäufer von Unternehmensinfrastruktur gezwungen, sich einer Realität zu stellen, die mehr als ein Jahrzehnt lang bequem ausgeblendet worden war.
Blog
Daten sind alles
Daten sind alles. Seit Jahrzehnten sage ich schon, dass „das Netzwerk die Plattform ist“, dass Rechenleistung ganze Branchen umgestaltet und dass Speicher die digitale Grundlage bildet. Aber die Wahrheit – die wahre Wahrheit – ist, dass all diese Bereiche nur deshalb von Bedeutung sind, weil Daten durch sie fließen.
Erste Schritte mit Qumulo in der Cloud
Starten Sie die Bereitstellung über das Azure-Portal, den AWS Marketplace oder den GCP Marketplace und führen Sie Ihre Workloads innerhalb weniger Minuten aus

Häufig gestellte Fragen
Nein, NeuralCache ist in die Qumulo-Plattform integriert und stellt keine separat abrechnungsfähige Funktion dar.
Ja, manche Workflows werden stärker beschleunigt als andere, aber NeuralCache wird die Leistung jedes einzelnen Workflows verbessern.
Bei einem herkömmlichen dateibasierten Workflow müssten Sie warten, bis eine gesamte Datei oder ein gesamtes Projekt vom Remote-Speicher heruntergeladen wurde, bevor Sie mit der Arbeit beginnen könnten. Stellen Sie sich vor, Sie möchten ein mehrere GB großes Video abspielen und müssten warten, bis es vollständig heruntergeladen ist, bevor Sie auf „Play“ klicken können. Mit Qumulo NeuralCache verschieben wir kleine Teile des Dateisystems intelligent in Ihre lokale Cloud oder Ihren lokalen Cluster, während Sie diese nutzen. NeuralCache sagt effektiv voraus, welche Blöcke wahrscheinlich als Nächstes benötigt werden, und lädt diese Daten bereits herunter, bevor Sie sie anfordern. Wenn Sie Ihre Tätigkeit ändern – beispielsweise beim Durchspulen einer Videodatei –, passt sich NeuralCache schnell an Ihre neuen Muster an und ruft die für Ihre aktuelle Arbeit relevanten Daten ab.
NeuralCache senkt die Kosten, indem es den Großteil der Leseanfragen direkt aus dem lokalen Cache bedient und so kostspielige GET-Anfragen an den Objektspeicher effektiv vermeidet. Auf der Schreibseite aggregiert, komprimiert und verdichtet das System neue Datenänderungen zu größeren, hocheffizienten Objektgrößen, bevor diese an den Objektspeicher gesendet werden. Durch diesen Prozess lassen sich Hunderte einzelner Schreibvorgänge zu einer einzigen PUT-Anfrage zusammenfassen, wodurch die Gesamtkosten für API-Aufrufe um bis zu 99 % gesenkt werden.
Im Bereich der KI ermöglicht NeuralCache Zero-Copy-Pipelines, bei denen Modelle Daten mit einer Latenz von unter einer Millisekunde direkt aus dem Namespace einlesen können, was zu schnelleren Startzeiten der Jobs und einer äußerst konsistenten Trainingsleistung führt. Im Bereich VFX und Medienproduktion lädt das System wichtige Assets (wie Rohmaterial, Texturen und Projektdateien) proaktiv vor. Dies sorgt für eine flüssige Medienwiedergabe, beseitigt Verzögerungen beim Scrollen in der Zeitleiste und verhindert Latenzspitzen während der Bearbeitung und des Renderings.
Anstatt darauf zu warten, dass eine Anwendung Daten anfordert, nutzt NeuralCache prädiktive Machine-Learning-Modelle, die anhand von Billionen realer Dateitransaktionen trainiert wurden. Es setzt einen kontinuierlich aktualisierten „digitalen Zwilling“ ein, um das Live-Verhalten von Anwendungen, Dateistrukturen und Zugriffsmuster zu analysieren. Durch die Kombination dieser Signale mit kurz- und langfristigen Heat-Scores prognostiziert das System präzise, welche Daten als Nächstes benötigt werden, und lädt diese proaktiv in hochleistungsfähige lokale Caches (wie NVMe und DRAM) vor, noch bevor die Anfrage überhaupt gestellt wird.