惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

酷 壳 – CoolShell
酷 壳 – CoolShell
宝玉的分享
宝玉的分享
P
Proofpoint News Feed
I
Intezer
云风的 BLOG
云风的 BLOG
A
About on SuperTechFans
aimingoo的专栏
aimingoo的专栏
Y
Y Combinator Blog
小众软件
小众软件
T
Threatpost
B
Blog
美团技术团队
博客园 - 司徒正美
T
The Exploit Database - CXSecurity.com
T
Tailwind CSS Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Cyberwarzone
Cyberwarzone
雷峰网
雷峰网
The GitHub Blog
The GitHub Blog
T
Tenable Blog
A
Arctic Wolf
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Security Archives - TechRepublic
Security Archives - TechRepublic
博客园 - 叶小钗
L
Lohrmann on Cybersecurity
博客园 - 三生石上(FineUI控件)
L
LINUX DO - 热门话题
J
Java Code Geeks
Google DeepMind News
Google DeepMind News
S
Security Affairs
Simon Willison's Weblog
Simon Willison's Weblog
K
Kaspersky official blog
C
CXSECURITY Database RSS Feed - CXSecurity.com
GbyAI
GbyAI
N
News and Events Feed by Topic
Cloudbric
Cloudbric
WordPress大学
WordPress大学
量子位
W
WeLiveSecurity
H
Hacker News: Front Page
Project Zero
Project Zero
S
Security @ Cisco Blogs
Security Latest
Security Latest
Hugging Face - Blog
Hugging Face - Blog
Forbes - Security
Forbes - Security
C
Cybersecurity and Infrastructure Security Agency CISA
人人都是产品经理
人人都是产品经理
U
Unit 42
Know Your Adversary
Know Your Adversary
Google Online Security Blog
Google Online Security Blog

heise online News

Machine Learning mit Python – KI und Deep Learning in 5 Sessions erklärt Porsche-Chef Leiters plant umfassenden Konzernumbau Studie: KI bleibt oft im Testlauf stecken iX-Workshop: Grundlagen und Prinzipien eines modernen IT-Managements Missing Link: Aus für De-Mail – warum das „@“ das eingekringelte „e“ besiegte Top 10: Android Auto & Carplay nachrüsten – das beste Display fürs Auto im Test BOS-Funk: ETSI standardisiert Funk für Behörden Repair-Cafés jubeln: Bundestag beschließt Ökodesign-Reform für Nachhaltigkeit Google wehrt sich gegen Monopol-Urteil CERN-Rat beschließt Strategie-Update: FCC-ee soll LHC-Nachfolger werden Product Owner AI Day 2026: Konferenz und Workshop für KI im Produktmanagement Taskforce sieht keine Knappheit bei Kerosin Aus dem Weg! E-Scooter Navee UT5 Max mit Kuhfänger und brachialer Power im Test Krankenhaus-IT: Geldmangel und schlechte Prozesse gefährden Digitalisierung „The Boroughs“: Opa entdeckt Stranger Things iX-Workshop: Lokales Active Directory gegen Angriffe absichern Google Pics und Tiger-Selfies – die Fotonews der Woche 21/2025 Fitbit-App bekommt großes Update auf Version 5.0 und heißt jetzt Google Health Zwischen Wellen, Weite und Wissenschaft: Die Bilder der Woche 21 Sonnenenergie effizient speichern und nutzen | c’t uplink Cyberangriff auf Abrechnungsdienstleister betrifft viele Kliniken Lizenzstreit und Cloud-Zwang: Bambu Lab unter massivem Druck Vom Postweg ins BundID-Konto: Bundestag stimmt für digitales Führungszeugnis Windows 11 ist ein kompletter Verkehrsunfall Europol legt VPN-Dienst lahm TV-Deals zur WM: Die besten Fernseher von OLED bis XXL zum Tiefstpreis Nvidia will mit Vera-Prozessoren nach der CPU-Krone greifen Googles XR-Brillen auf der I/O: Project Aura & Prototyp ausprobiert Proxmox VE 9.2 mit Dynamic Load Balancer und Linux Kernel 7.0 Großstadt blockiert Überwachungssoftware Palantir Gelöscht und doch nicht weg: Signal speichert Nachrichten länger als erwartet SADAS: Neue Software warnt Fahrer vor Gefahrenzonen im Straßenraum Drei Fragen und Antworten: Wann sich KI-Coding wirklich rechnet Metas KI-Brillen helfen Blinden im Alltag – und werfen neue Fragen auf Fotoanbieter Portraitbox: Erpressung nach Sicherheitsvorfall? KI-Update: Google I/O-Fazit, Anthropic, Nvidia, Gehirn und KI-Parallelen Avatare und Augmented Reality: Apple schnappt sich kleines Start-up Won’t fix! – Teil 1: Warum Softwareschätzungen so zuverlässig falsch sind Virtual OS Museum: Über 1700 alte Betriebssysteme in einer VM Navee XT5 Max Test: Brachialer E-Scooter mit 2200 Watt ist Outdoor-Testsieger Airbnb personalisiert App mit KI IT-Ausfälle immer teurer für große Unternehmen Betrug im App Store: Apple stoppt laut eigenen Angaben Milliarden-Verluste TGIQF: Das Quiz rund um Hubschrauber Verbraucherschützer fordern Schadensersatz für Nutzer bei Smart-Meter-Problemen Citroën kündigt Elektroauto mit dem Namen „2CV“ an Software Testing: So ändert Agentic Engineering die Softwareentwicklung Post zum Freitag: Clever durch den Urlaub – schlauer reisen, entspannter surfen iX-Workshop: Sicherer Betrieb von Windows 11 im Unternehmen Camunda: ProcessOS optimiert Geschäftsprozesse mit KI macOS kann bald barrierefreien Sony-Access-Controller nutzen Elektro-Sportenduro Radian EXR vorgestellt: Viel Kraft aus Wechselakkus Voice Control in iOS 27: Accessibility-Feature sagt Siri-App-Steuerung voraus Stellantis stellt neue Plattform für neuen Strategieplan vor Spotify: Neue Desktop-App erstellt personalisierte KI-Podcasts Zum Jahresende: Bundestag beschließt Ende der De-Mail Bluesky: Russische Akteure kapern angeblich Accounts und verbreiten Propaganda Dell PowerEdge: Bis zu 70 Prozent mehr Leistung für Rechenzentren Forscher nutzen Vakuumprozess zur Herstellung von effizienten Tandemsolarzellen Jubiläum: Apple Retail Stores seit 25 Jahren im Geschäft Spotify kündigt KI-generierte Remixe und Podcasts an IT Summit 2026: heise-Konferenz zu Digitaler Souveränität „Helldivers 2“: DLSS 4.5, FSR 4 und XeSS 3.0 kommen am 27. Mai Passend zur Fußball-WM: Apple verbessert Sports-App „Gemini built in“: Google bietet Referenzdesigns für Smart-Home-Geräte an Neu in .NET 10.0 [24]: LINQ-Operatoren RightJoin() und LeftJoin() in EF Core Drei „Tomb Raider“-Klassiker im Epic Games Store kostenlos Apache-Airflow-Komponenten: Angreifer können Datenbank modifizieren Notepad++: Update bessert Schwachstelle im Installer aus Halbleiter-Ökosystem: Studie beschreibt EU-Problemzonen Stellantis-Umbau: Fokus auf Kernmarken und Kapazitätsabbau in Europa Cisco stopft Sicherheitsleck mit Höchstwertung in Secure Workload „GTA 6“ erscheint wie geplant am 19. November Samsung: Abstimmung über Boni von Hunderttausenden Euro pro Mitarbeiter Vier Arme sind besser als zwei: Humanoider Roboter für die Schwerelosigkeit Kopfhörer mit KI-Chip made in Germany: Soundcore Liberty 5 Pro ausprobiert iX-Workshop: Sicheres Active Directory – Adminrechte mit Tiering schützen Destiny-Ära endet: Bungie beendet Entwicklung von „Destiny 2" Riesenrakete Starship: SpaceX hat den nächsten Testflug erneut verschoben Trend Micro Apex One und Langflow: Warnung vor Angriffen Kann WhatsApp verschlüsselte Nachrichten einsehen? Texas reicht Klage ein Passiv-PC Arctic senza AI 370 im Test: Schnell, lautlos, unsichtbar Warhammer Skulls 2026: Die volle Ladung „Warhammer“-Videospiele Freitag: Robotaxi-Probleme in den USA, Australiens Kinderschutz-Strafe gegen X Vorsicht, Kunde! – Wenn der Gutschein plötzlich wertlos wird Waymo stoppt Autobahnfahrten und Robotaxi-Dienste in Städten mit Starkregen Privacy Guardrail: Chrome-Erweiterung will sensible Daten vor Chatbots schützen Mit dem Deutschland-Stack samt Zertifizierung zur digitalen Souveränität X kooperierte nicht mit Behörde: Höhere Strafe in Australien GMX bringt KI ins Postfach: Wir haben den Assistenten ausprobiert Digitale Souveränität: OpenDesk laut Studie keine volle Microsoft-Alternative Digitale Souveränität: Bund vergibt 250-Millionen-KI-Cloud-Auftrag Kupfer-Glas-Migration: „Homes connected macht keinen Sinn“ Teure Kultur: Justizministerin Hubig kündigt Kampf gegen Ticketwucher an Top 10: Der beste Wireless Charger mit Qi2 im Test – Magsafe-Ladegerät für alle AMDs offizieller Mini-PC kostet 3999 US-Dollar WordPress: Offizielles Plug-in bindet Blogs direkt ins Bluesky-Protokoll ein KI beweist: Mathematiker lagen falsch re:publica: Große Fragen, kaum Antworten Fritz Labor 8.40 bereitet Fritzboxen auf Matter vor
HPE: AI-Factory als Turnkey-System
Harald Weiss · 2026-06-23 · via heise online News

HPE hat auf der HPE Discover in Las Vegas seine KI-Plattform deutlich erweitert. Lag die bisherige GPU-Obergrenze bei 64, sind nun bis zu 256 GPUs möglich. Kunden können mit kleinen Konfigurationen starten und die Leistung später über zusätzliche Racks ausbauen. Außer den ProLiant-Servern mit Nvidia-Beschleunigern gehören Storage, Data Fabric sowie Software für Modelle, KI-Anwendungen und Agenten zu dem System. Morpheus übernimmt dabei die Steuerung, OpsRamp die Überwachung.

Die Installation und Integration sind Bestandteil des Angebots. HPE liefert die gesamte Umgebung zu einem festen Gesamtpreis. Ziel ist es, Unternehmen davon zu befreien, sich eine eigene KI-Fabrik aus einzelnen Hardware-, Software- und weiteren Bausteinen selbst zusammensetzen zu müssen.

HPEs Private Cloud AI integriert Nvidia AI Enterprise sowie kuratierte Modelle und Entwicklungswerkzeuge. Hinzu kommen das Nvidia Agent Toolkit, Nemotron-Modelle, NemoClaw und OpenShell. Agenten lassen sich darüber registrieren, bereitstellen und mit Zugriffsregeln versehen. Auf der Compute-Seite wird das Angebot um Systeme mit Nvidia RTX Pro 6000 Blackwell Server Edition ergänzt.

Außerdem hat HPE den ProLiant DL394 Gen12 mit Nvidias Arm-basierter Vera-CPU angekündigt. Diese CPU übernimmt die speicher- und steuerungsintensiven Teile von agentischen Anwendungen und arbeitet eng mit den Nvidia-GPUs zusammen. Damit konzentriert sich HPE bei seiner Private Cloud AI auf Nvidias Hard- und Softwarestack. Diese enge Abstimmung reduziert den Integrationsaufwand, bedeutet aber weniger Flexibilität bei der Auswahl von Beschleunigern und Laufzeitumgebungen.

Eine zentrale Rolle in der neuen KI-Plattform übernimmt Alletra Storage MP X10000. Die Plattform stellt Datei- und Objektspeicher auf einer gemeinsamen Architektur bereit und wird direkt in Private Cloud AI eingebunden. HPE nutzt das System außerdem als ausgelagerten Speicher für den Performance-relevanten KV-Cache. Sprachmodelle speichern im KV-Cache Informationen über bereits verarbeitete Texte, Zusammenhänge und Zwischenergebnisse. Bei weiteren Anfragen greifen sie auf diesen Kontext zurück, statt ihn jedes Mal neu zu berechnen.

Das ist besonders bei längeren Prompts, vielen Dokumenten und mehreren parallel arbeitenden Agenten wichtig. Je länger der Kontext und je mehr Anfragen gleichzeitig laufen, desto stärker wächst der Speicherbedarf. Werden ältere Kontextinformationen verdrängt, muss das Modell sie bei späteren Anfragen erneut berechnen. Das erhöht Latenz, Energieverbrauch und Kosten. In einer agentischen Umgebung verschärft sich das Problem, weil Agenten nicht nur einmal antworten, sondern wiederholt prüfen, planen, Daten abrufen und Aktionen vorbereiten.

HPE lagert deshalb Teile des KV-Caches per Remote Direct Memory Access auf den X10000 aus. Dabei werden die Daten direkt zwischen Storage und Arbeitsspeicher übertragen, ohne den üblichen Umweg über mehrere Verarbeitungsschichten des Betriebssystems zu nehmen. Damit übernimmt die Storage-Einheit einen Teil des GPU-Speichers und wird Teil der Inferenz. Laut HPE konnte in einer eigenen Testkonfiguration mit Nvidia-H200-GPUs und dem Modell Nemotron 70B die Zeit bis zum ersten ausgegebenen Token um den Faktor 20 verkürzt werden. Dabei soll der Durchsatz um den Faktor 17 gestiegen sein.

Das neue Data Fabric 8.2 erfasst und katalogisiert verteilte Datenbestände. Ein globaler Katalog zeigt, welche Informationen vorhanden sind und wo sie sich befinden. Metadaten, Identitäten und Zugriffsrichtlinien legen fest, welche Anwendungen oder Agenten auf bestimmte Bestände zugreifen dürfen. Das Data Fabric wird auch als vorkonfigurierte Appliance auf ProLiant-Servern angeboten. Innerhalb des Gesamtstacks übernimmt der X10000 den schnellen Zugriff auf die Daten, während Data Fabric die Bestände auffindbar und kontrolliert nutzbar macht.

Technische Datenorganisation allein macht Daten allerdings noch nicht KI-tauglich. Für Training und Agenten müssen die Daten zunächst klassifiziert, bereinigt, beschrieben und mit Berechtigungen versehen werden. Trotz automatisierter Werkzeuge bleibt dieser Prozess teilweise manuell. Fachabteilungen müssen beispielsweise erklären, was bestimmte Daten bedeuten, wie aktuell sie sind und für welche Zwecke sie verwendet werden dürfen.

Für den Betrieb der integrierten KI-Umgebung setzt HPE auf Morpheus, OpsRamp und GreenLake Intelligence. Morpheus stellt Rechen-, Speicher- und Laufzeitressourcen bereit und orchestriert die Private-Cloud-Infrastruktur. OpsRamp sammelt Telemetriedaten und überwacht die Abhängigkeiten zwischen den Anwendungen, Modellen und der darunterliegenden Infrastruktur. Neu ist jetzt die engere Verbindung dieser Betriebsfunktionen mit KI-gestützter Automatisierung. Morpheus Central soll mehrere Installationen über Rechenzentren, Regionen und Edge-Standorte hinweg sichtbar machen.

Für KI-Umgebungen ist das relevant, weil Modelle, Daten und Inferenzdienste häufig nicht an einem einzelnen Ort laufen. OpsRamp soll Störungen nicht nur sammeln, sondern korrelieren und Ursachen in der Infrastruktur erkennen. HPE ergänzt diese Ebene um Copilot-Funktionen und MCP-Schnittstellen. Dabei kann Morpheus Copilot Blueprints und Automatisierungen anhand von natürlichen Sprachanweisungen erstellen. OpsRamp Copilot soll Ereignisse analysieren und Abhilfemaßnahmen unterstützen. Ein MCP-Server stellt standardisierte Schnittstellen bereit, über die Agenten auf Verwaltungs- und Automatisierungsfunktionen zugreifen können. GreenLake Intelligence führt diese Funktionen in einer gemeinsamen Bedienebene zusammen.

HPE ergänzt den Stack um Funktionen zur Kontrolle von KI-Agenten. Diese erhalten eigene Identitäten und laufen in isolierten Umgebungen. Richtlinien legen fest, welche Daten, Schnittstellen und Werkzeuge sie verwenden dürfen. Für kritische Aktionen lassen sich menschliche Freigaben vorschreiben. Zerto bildet eine zusätzliche Rückfallebene. Die Software zeichnet Änderungen auf und setzt betroffene Systeme bei Bedarf auf einen früheren Zustand zurück. Sie erkennt allerdings nicht, ob eine Entscheidung fachlich falsch oder regulatorisch unzulässig war.

Für HPE bedeutet Governance vor allem technische Zugriffskontrolle und Policy Enforcement. Fachliche Modellvalidierung, Bias-Prüfung, regulatorische Einordnung und die Zuweisung von Verantwortung bleiben Aufgaben außerhalb der Plattform. Gerade hier hapert es bei vielen Private-AI-Strategien. Eine eigene Infrastruktur erhöht zwar die Kontrolle über Daten und Betrieb, ersetzt aber keine Governance. IBM und Red Hat haben zuletzt darauf hingewiesen, dass viele Unternehmen ihre Abhängigkeiten von KI-Anbietern, Modellen und Infrastruktur nur unvollständig überblicken. Eine Private Cloud kann solche Abhängigkeiten transparenter machen; auflösen lässt sie sie nicht.

Die Angebote im Markt für AI-Factories unterscheiden sich deutlich. Dell setzt beispielsweise auf eine disaggregierte Infrastruktur, bei der Compute und Storage unabhängig voneinander skaliert werden können. HPE bündelt dagegen Hardware, Datenplattform und Betriebssoftware enger zu einem festgelegten Gesamtsystem.

Das verlagert die Integrationsarbeit vom Kunden zum Hersteller, reduziert aber die Freiheitsgrade. Besonders die Abhängigkeit von Nvidia wächst, weil HPE neben den GPUs auch CPUs, Modelle, Laufzeitumgebungen und Agentenwerkzeuge des Partners integriert. Der Vorteil sind die gut abgestimmten Komponenten. Der Nachteil: Wer einzelne Bausteine austauschen will, stößt schneller an die Grenzen der Architektur.

HPEs KI-Angebot als Private Cloud liegt im Trend. Mit der Verlagerung von KI aus Pilotprojekten in den produktiven Betrieb ändert sich die Infrastrukturrechnung: Public-Cloud-Dienste bleiben für Tests, flexible Lasten und den schnellen Zugriff auf neue Modelle attraktiv; bei dauerhafter Inferenz, agentischen Workflows und sensiblen Daten rücken jedoch Kostenkontrolle und Datenzugriff in den Vordergrund.

Deloitte sieht bei konstant hohen KI-Lasten einen wirtschaftlichen Kipppunkt: Wenn Cloudkosten einen großen Teil der Kosten vergleichbarer eigener Systeme erreichen, können Private-Cloud-Ansätze günstiger werden. Forrester erwartet ebenfalls, dass die Unternehmen wegen steigender KI-Kosten, Daten-Lock-in und Betriebsrisiken verstärkt auf private KI-Clouds setzen. HPE positioniert seine Private Cloud AI auch nicht als Gegenentwurf zur Public Cloud, sondern als Betriebsplattform für KI-Workloads, die näher an den Daten und Prozessen angesiedelt sein müssen.

Einziger Wermutstropfen: Der vollständige Stack steht noch nicht komplett bereit. Ein Teil der angekündigten Funktionen und Integrationen kommt erst in den kommenden Quartalen auf den Markt.

(axk)