惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - Franky
Microsoft Azure Blog
Microsoft Azure Blog
阮一峰的网络日志
阮一峰的网络日志
宝玉的分享
宝玉的分享
量子位
N
Netflix TechBlog - Medium
M
MIT News - Artificial intelligence
GbyAI
GbyAI
Apple Machine Learning Research
Apple Machine Learning Research
博客园_首页
博客园 - 叶小钗
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
酷 壳 – CoolShell
酷 壳 – CoolShell
T
Tailwind CSS Blog
Y
Y Combinator Blog
L
LangChain Blog
The Cloudflare Blog
T
The Blog of Author Tim Ferriss
U
Unit 42
Martin Fowler
Martin Fowler
aimingoo的专栏
aimingoo的专栏
G
Google Developers Blog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
月光博客
月光博客

heise online News

Machine Learning mit Python – KI und Deep Learning in 5 Sessions erklärt Porsche-Chef Leiters plant umfassenden Konzernumbau Studie: KI bleibt oft im Testlauf stecken iX-Workshop: Grundlagen und Prinzipien eines modernen IT-Managements Missing Link: Aus für De-Mail – warum das „@“ das eingekringelte „e“ besiegte Top 10: Android Auto & Carplay nachrüsten – das beste Display fürs Auto im Test BOS-Funk: ETSI standardisiert Funk für Behörden Repair-Cafés jubeln: Bundestag beschließt Ökodesign-Reform für Nachhaltigkeit Google wehrt sich gegen Monopol-Urteil CERN-Rat beschließt Strategie-Update: FCC-ee soll LHC-Nachfolger werden Product Owner AI Day 2026: Konferenz und Workshop für KI im Produktmanagement Taskforce sieht keine Knappheit bei Kerosin Aus dem Weg! E-Scooter Navee UT5 Max mit Kuhfänger und brachialer Power im Test Krankenhaus-IT: Geldmangel und schlechte Prozesse gefährden Digitalisierung „The Boroughs“: Opa entdeckt Stranger Things iX-Workshop: Lokales Active Directory gegen Angriffe absichern Google Pics und Tiger-Selfies – die Fotonews der Woche 21/2025 Fitbit-App bekommt großes Update auf Version 5.0 und heißt jetzt Google Health Zwischen Wellen, Weite und Wissenschaft: Die Bilder der Woche 21 Sonnenenergie effizient speichern und nutzen | c’t uplink Cyberangriff auf Abrechnungsdienstleister betrifft viele Kliniken Lizenzstreit und Cloud-Zwang: Bambu Lab unter massivem Druck Vom Postweg ins BundID-Konto: Bundestag stimmt für digitales Führungszeugnis Windows 11 ist ein kompletter Verkehrsunfall Europol legt VPN-Dienst lahm TV-Deals zur WM: Die besten Fernseher von OLED bis XXL zum Tiefstpreis Nvidia will mit Vera-Prozessoren nach der CPU-Krone greifen Googles XR-Brillen auf der I/O: Project Aura & Prototyp ausprobiert Proxmox VE 9.2 mit Dynamic Load Balancer und Linux Kernel 7.0 Großstadt blockiert Überwachungssoftware Palantir
Anthropic bringt „ehrlicheres“ Claude Opus 4.8 – und künd...
Dr. Volker Zota · 2026-05-29 · via heise online News

Was für Microsoft der Patch Tuesday, ist für Anthropic der Release Thursday: Claude Opus 4.8 ist ab sofort verfügbar – zum gleichen Preis wie Vorgänger Opus 4.7, der erst Mitte April freigegeben wurde. Wenig überraschend soll sich das neue Modell in Benchmarks für Coding, agentische Fähigkeiten, Reasoning und Wissensarbeit weiter verbessert haben, ist allerdings nicht in jeder Diziplin Benchmarksieger. Begleitend zum Modell-Update stellt das Unternehmen mehrere neue Funktionen bereit, die primär auf autonomes, großskaliges Arbeiten abzielen.

Benchmarktabelle

Ausgerechnet in einer der Paradediziplinen der Anthropic-Modelle muss sich Opus 4.8 OpenAIs GPT-5.5 geschlagen geben, wenn auch nur im Terminal Bench 2.1.

Laut Anthropic macht Opus 4.8 Unsicherheiten häufiger kenntlich und stellt seltener ungestützte Behauptungen auf als sein Vorgänger. In selbst geschriebenem Code lasse das neue Modell Fehler viermal seltener unkommentiert passieren als noch Opus 4.7.

Das hauseigene Alignment-Team bescheinigt dem Modell zudem angeblich neue Bestwerte bei sogenannten „prosozialen Eigenschaften“ – darunter die Unterstützung der Nutzerautonomie und das Handeln im Nutzerinteresse. Falsch ausgerichtetes Verhalten wie Täuschung oder Kooperation bei Missbrauch soll gegenüber Opus 4.7 deutlich seltener auftreten und auf dem Niveau des laut Anthropic bisher am besten ausgerichteten Modells, Claude Mythos Preview, liegen.

Neu ist die Funktion „Dynamic Workflows“, die in der Forschungsvorschau für Claude Code verfügbar ist. Damit soll Claude Code komplexe Aufgaben aufteilen, Hunderte parallele Subagenten in einer einzigen Sitzung starten und die Ergebnisse vor der Ausgabe prüfen können. Als Beispiel nennt Anthropic Codebase-weite Migrationen über Hunderttausende Zeilen Code – von der Aufgabenstellung bis zum fertigen Merge. Die Funktion steht Enterprise-, Team- und Max-Plänen zur Verfügung.

Nutzerinnen und Nutzer auf claude.ai erhalten mit Opus 4.8 eine neue Effort-Control-Funktion. Damit lässt sich direkt neben der Modellauswahl einstellen, wie viel Aufwand Claude in eine Antwort investieren soll – von schnelleren, ressourcenschonenderen Antworten bis zu tieferem Nachdenken für schwierige Aufgaben.

Der Fast Mode – bei dem Opus 4.8 mit 2,5-facher Geschwindigkeit arbeiten soll – ist im Vergleich zum Vorgängermodell um zwei Drittel günstiger. Der reguläre API-Preis bleibt unverändert: 5 US-Dollar pro Million Input-Token und 25 US-Dollar pro Million Output-Token. Im Fast Mode kostet es 10 beziehungsweise 50 US-Dollar.

Für Entwickler kommt eine neue API-Funktion hinzu: Die Messages API akzeptiert ab sofort System-Einträge innerhalb des Messages-Arrays. Damit ließen sich Anweisungen mitten in einer laufenden Aufgabe aktualisieren, ohne den Prompt-Cache zu unterbrechen.

Claude Opus 4.8 ist ab sofort über die API unter dem Modellnamen claude-opus-4-8 sowie auf claude.ai verfügbar.

Parallel zur Veröffentlichung von Opus 4.8 kündigt Anthropic an, Modelle der Mythos-Klasse in den nächsten Wochen für alle Kunden verfügbar zu machen. Die Entwicklung der nötigen Schutzmaßnahmen schreite zügig voran, heißt es seitens Anthropic.

Bislang ist Claude Mythos Preview nur einem sehr engen Kreis zugänglich. Im Rahmen von „Project Glasswing“ erhalten rund 40 weitere ausgewählte Unternehmen kritischer Infrastruktur Zugang, um ihre Systeme auf Schwachstellen zu prüfen. Der Plan, diesen Kreis auf rund 70 weitere Unternehmen auszuweiten, stieß auf Widerstand aus dem Weißen Haus – mit Verweis auf Sicherheitsbedenken und mögliche Kapazitätsengpässe.

Anthropic begründet die bisherige Zurückhaltung mit der außergewöhnlichen Leistungsfähigkeit des Modells beim Auffinden und Ausnutzen von Sicherheitslücken. Das KI-gestützte Schwachstellenscanner-Produkt Claude Security basiert dagegen auf dem weniger mächtigen Opus 4.7 und steht seit Ende April allen Enterprise-Kunden zur Verfügung.

Ende April hat OpenAI GPT-5.5 vorgestellt, das ebenfalls stark auf agentisches Arbeiten setzt. Metas Llama 4 kam im April als Open-Weight-Modell mit Mixture-of-Experts-Architektur – und dem Versprechen, dass sich Open-Source-Modelle langfristig durchsetzen werden. Ebenfalls als Open-Weights-Modell ist das europäische Mistral Medium 3.5 verfügbar, das Datensouveränität und Selbst-Hosting in den Vordergrund stellt und dabei mit nur vier GPUs auskommen soll.

(vza)