惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 【当耐特】
Stack Overflow Blog
Stack Overflow Blog
V
Visual Studio Blog
小众软件
小众软件
The Cloudflare Blog
T
Tailwind CSS Blog
Apple Machine Learning Research
Apple Machine Learning Research
爱范儿
爱范儿
美团技术团队
WordPress大学
WordPress大学
罗磊的独立博客
Microsoft Azure Blog
Microsoft Azure Blog
A
About on SuperTechFans
Last Week in AI
Last Week in AI
月光博客
月光博客
博客园 - Franky
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
G
Google Developers Blog
GbyAI
GbyAI
B
Blog
大猫的无限游戏
大猫的无限游戏
博客园 - 聂微东
Hugging Face - Blog
Hugging Face - Blog
博客园 - 叶小钗

heise online News

Machine Learning mit Python – KI und Deep Learning in 5 Sessions erklärt Porsche-Chef Leiters plant umfassenden Konzernumbau Studie: KI bleibt oft im Testlauf stecken iX-Workshop: Grundlagen und Prinzipien eines modernen IT-Managements Missing Link: Aus für De-Mail – warum das „@“ das eingekringelte „e“ besiegte Top 10: Android Auto & Carplay nachrüsten – das beste Display fürs Auto im Test BOS-Funk: ETSI standardisiert Funk für Behörden Repair-Cafés jubeln: Bundestag beschließt Ökodesign-Reform für Nachhaltigkeit Google wehrt sich gegen Monopol-Urteil CERN-Rat beschließt Strategie-Update: FCC-ee soll LHC-Nachfolger werden Product Owner AI Day 2026: Konferenz und Workshop für KI im Produktmanagement Taskforce sieht keine Knappheit bei Kerosin Aus dem Weg! E-Scooter Navee UT5 Max mit Kuhfänger und brachialer Power im Test Krankenhaus-IT: Geldmangel und schlechte Prozesse gefährden Digitalisierung „The Boroughs“: Opa entdeckt Stranger Things iX-Workshop: Lokales Active Directory gegen Angriffe absichern Google Pics und Tiger-Selfies – die Fotonews der Woche 21/2025 Fitbit-App bekommt großes Update auf Version 5.0 und heißt jetzt Google Health Zwischen Wellen, Weite und Wissenschaft: Die Bilder der Woche 21 Sonnenenergie effizient speichern und nutzen | c’t uplink Cyberangriff auf Abrechnungsdienstleister betrifft viele Kliniken Lizenzstreit und Cloud-Zwang: Bambu Lab unter massivem Druck Vom Postweg ins BundID-Konto: Bundestag stimmt für digitales Führungszeugnis Windows 11 ist ein kompletter Verkehrsunfall Europol legt VPN-Dienst lahm TV-Deals zur WM: Die besten Fernseher von OLED bis XXL zum Tiefstpreis Nvidia will mit Vera-Prozessoren nach der CPU-Krone greifen Googles XR-Brillen auf der I/O: Project Aura & Prototyp ausprobiert Proxmox VE 9.2 mit Dynamic Load Balancer und Linux Kernel 7.0 Großstadt blockiert Überwachungssoftware Palantir
KI-Inferencing: US-deutsches Start-up will Nvidia ausstechen
Christof Windeck · 2026-06-16 · via heise online News

Das 2017 unter dem Namen Recogni gegründete Unternehmen Tensordyne meldet den sogenannten Tape-Out seines KI-Beschleunigers „Napier“. Der Name verweist auf John Napier, der als Erfinder des Logarithmierens als Rechenhilfe gilt. Der Napier-Chip soll dank logarithmischer Mathematik die zahlreichen Multiplikationen, die bei der Anwendung von KI-Modellen nötig sind, in Additionen verwandeln.

Weil sich Additionen effizienter berechnen lassen, verspricht Tensordyne wesentlich höhere Rechenleistung pro Rack als bei KI-Servern mit der noch aktuellen Nvidia-Technik GB300. Je nach KI-Modell soll ein Napier-Rack bis zu 13-mal so viele Tokens pro Sekunde liefern wie ein Nvidia GB300 NVL72.

Die Effizienz, gerechnet in Tokens pro Sekunde pro Watt, soll sogar bis zum Faktor 17 besser sein.

Nach Angaben des Unternehmens liegen bereits Bestellungen für Napier-Systeme im Gesamtwert von mehr als 200 Millionen US-Dollar vor. Wann genau die ersten TDN72-Pods ausgeliefert werden sollen, verrät Tensordyne bisher jedoch nicht.

Bis Ende 2026 will Nvidia allerdings das gezielt für Inferencing optimierte System Groq 3 LPX auf den Markt bringen. Das einst ebenfalls für Inferencing angekündigte Rubin CPX ist damit wohl vom Tisch.

Durch die logarithmische Rechenweise können die eigentlichen Rechenwerke des Napier kleiner ausfallen, sodass mehr davon auf den Chip passen und Platz für schnelles SRAM bleibt. Jeder Chip ist mit 144 GByte HBM3E-RAM gekoppelt. Außerdem baut Teledyne einen besonders schnellen Interconnect ein.

Ein TDN72 Pod besteht aus vier eng vernetzten Rack-Einschüben mit je neun Napier-Chips. Ein Tensordyne Napier Rack (TDN Rack) wiederum besteht aus vier TDN72-Pods, also 288 Napier-Chips.

Der Aufbau des Tensordyne Rack aus vier TDN72-Pods mit je 72 „Napier“-Prozessoren.

(Bild: Tensordyne)

Das TDN Rack leistet 608 PFlops, hat 42 TByte HBM3E, 78 GByte SRAM und 256 TByte RAM. Es nimmt unter Volllast 120 Kilowatt Leistung auf und kommt mit Luftkühlung aus. Der Interconnect im Rack überträgt bis zu 275 TByte/s.

Der Napier-Chip soll unter anderem die Datenformate FP16, FP8, FP4 und Int8 verarbeiten. Er eignet sich laut Tensordyne für gängige KI-Modelle wie Kimi K2.6, DeepSeek-R1/V4 Pro, Llama3.1 405B, Mixtral 8x22B, GPT-OSS-120B und Qwen 80B.

Zum Vergleich: Nvidia will in ein Groq-3-LPX-Rack insgesamt 256 Groq-3-LPUs einbauen, jede mit 500 MByte SRAM. Das ergibt pro Rack 128 GByte SRAM, dazu kommen 12 TByte DDR5-RAM.

Der Hauptsitz von Tensordyne liegt im Silicon Valley, eine Niederlassung besteht in München. Mehrere leitende Entwickler waren früher bei der Firma Juniper Networks tätig, die heute zu HPE gehört.

Bei der Entwicklung des Napier kooperierte Tensordyne mit Broadcom. Broadcom entwickelt auch KI-Chips für andere Firmen, beispielsweise mehrere Generationen der TPUs von Google.

(ciw)