惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Recent Announcements
Recent Announcements
雷峰网
雷峰网
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Hugging Face - Blog
Hugging Face - Blog
博客园 - 司徒正美
人人都是产品经理
人人都是产品经理
博客园 - 【当耐特】
量子位
有赞技术团队
有赞技术团队
博客园 - 三生石上(FineUI控件)
博客园 - Franky
M
MIT News - Artificial intelligence
U
Unit 42
Last Week in AI
Last Week in AI
酷 壳 – CoolShell
酷 壳 – CoolShell
The Cloudflare Blog
J
Java Code Geeks
V
Visual Studio Blog
Engineering at Meta
Engineering at Meta
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
MyScale Blog
MyScale Blog
T
Tailwind CSS Blog
T
The Blog of Author Tim Ferriss
V
V2EX

heise online News

Machine Learning mit Python – KI und Deep Learning in 5 Sessions erklärt Porsche-Chef Leiters plant umfassenden Konzernumbau Studie: KI bleibt oft im Testlauf stecken iX-Workshop: Grundlagen und Prinzipien eines modernen IT-Managements Missing Link: Aus für De-Mail – warum das „@“ das eingekringelte „e“ besiegte Top 10: Android Auto & Carplay nachrüsten – das beste Display fürs Auto im Test BOS-Funk: ETSI standardisiert Funk für Behörden Repair-Cafés jubeln: Bundestag beschließt Ökodesign-Reform für Nachhaltigkeit Google wehrt sich gegen Monopol-Urteil CERN-Rat beschließt Strategie-Update: FCC-ee soll LHC-Nachfolger werden Product Owner AI Day 2026: Konferenz und Workshop für KI im Produktmanagement Taskforce sieht keine Knappheit bei Kerosin Aus dem Weg! E-Scooter Navee UT5 Max mit Kuhfänger und brachialer Power im Test Krankenhaus-IT: Geldmangel und schlechte Prozesse gefährden Digitalisierung „The Boroughs“: Opa entdeckt Stranger Things iX-Workshop: Lokales Active Directory gegen Angriffe absichern Google Pics und Tiger-Selfies – die Fotonews der Woche 21/2025 Fitbit-App bekommt großes Update auf Version 5.0 und heißt jetzt Google Health Zwischen Wellen, Weite und Wissenschaft: Die Bilder der Woche 21 Sonnenenergie effizient speichern und nutzen | c’t uplink Cyberangriff auf Abrechnungsdienstleister betrifft viele Kliniken Lizenzstreit und Cloud-Zwang: Bambu Lab unter massivem Druck Vom Postweg ins BundID-Konto: Bundestag stimmt für digitales Führungszeugnis Windows 11 ist ein kompletter Verkehrsunfall Europol legt VPN-Dienst lahm TV-Deals zur WM: Die besten Fernseher von OLED bis XXL zum Tiefstpreis Nvidia will mit Vera-Prozessoren nach der CPU-Krone greifen Googles XR-Brillen auf der I/O: Project Aura & Prototyp ausprobiert Proxmox VE 9.2 mit Dynamic Load Balancer und Linux Kernel 7.0 Großstadt blockiert Überwachungssoftware Palantir
KI-Inferencing: US-deutsches Start-up will Nvidia ausstechen
Christof Windeck · 2026-06-16 · via heise online News

Das 2017 unter dem Namen Recogni gegründete Unternehmen Tensordyne meldet den sogenannten Tape-Out seines KI-Beschleunigers „Napier“. Der Name verweist auf John Napier, der als Erfinder des Logarithmierens als Rechenhilfe gilt. Der Napier-Chip soll dank logarithmischer Mathematik die zahlreichen Multiplikationen, die bei der Anwendung von KI-Modellen nötig sind, in Additionen verwandeln.

Weil sich Additionen effizienter berechnen lassen, verspricht Tensordyne wesentlich höhere Rechenleistung pro Rack als bei KI-Servern mit der noch aktuellen Nvidia-Technik GB300. Je nach KI-Modell soll ein Napier-Rack bis zu 13-mal so viele Tokens pro Sekunde liefern wie ein Nvidia GB300 NVL72.

Die Effizienz, gerechnet in Tokens pro Sekunde pro Watt, soll sogar bis zum Faktor 17 besser sein.

Nach Angaben des Unternehmens liegen bereits Bestellungen für Napier-Systeme im Gesamtwert von mehr als 200 Millionen US-Dollar vor. Wann genau die ersten TDN72-Pods ausgeliefert werden sollen, verrät Tensordyne bisher jedoch nicht.

Bis Ende 2026 will Nvidia allerdings das gezielt für Inferencing optimierte System Groq 3 LPX auf den Markt bringen. Das einst ebenfalls für Inferencing angekündigte Rubin CPX ist damit wohl vom Tisch.

Durch die logarithmische Rechenweise können die eigentlichen Rechenwerke des Napier kleiner ausfallen, sodass mehr davon auf den Chip passen und Platz für schnelles SRAM bleibt. Jeder Chip ist mit 144 GByte HBM3E-RAM gekoppelt. Außerdem baut Teledyne einen besonders schnellen Interconnect ein.

Ein TDN72 Pod besteht aus vier eng vernetzten Rack-Einschüben mit je neun Napier-Chips. Ein Tensordyne Napier Rack (TDN Rack) wiederum besteht aus vier TDN72-Pods, also 288 Napier-Chips.

Der Aufbau des Tensordyne Rack aus vier TDN72-Pods mit je 72 „Napier“-Prozessoren.

(Bild: Tensordyne)

Das TDN Rack leistet 608 PFlops, hat 42 TByte HBM3E, 78 GByte SRAM und 256 TByte RAM. Es nimmt unter Volllast 120 Kilowatt Leistung auf und kommt mit Luftkühlung aus. Der Interconnect im Rack überträgt bis zu 275 TByte/s.

Der Napier-Chip soll unter anderem die Datenformate FP16, FP8, FP4 und Int8 verarbeiten. Er eignet sich laut Tensordyne für gängige KI-Modelle wie Kimi K2.6, DeepSeek-R1/V4 Pro, Llama3.1 405B, Mixtral 8x22B, GPT-OSS-120B und Qwen 80B.

Zum Vergleich: Nvidia will in ein Groq-3-LPX-Rack insgesamt 256 Groq-3-LPUs einbauen, jede mit 500 MByte SRAM. Das ergibt pro Rack 128 GByte SRAM, dazu kommen 12 TByte DDR5-RAM.

Der Hauptsitz von Tensordyne liegt im Silicon Valley, eine Niederlassung besteht in München. Mehrere leitende Entwickler waren früher bei der Firma Juniper Networks tätig, die heute zu HPE gehört.

Bei der Entwicklung des Napier kooperierte Tensordyne mit Broadcom. Broadcom entwickelt auch KI-Chips für andere Firmen, beispielsweise mehrere Generationen der TPUs von Google.

(ciw)