惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Martin Fowler
Martin Fowler
大猫的无限游戏
大猫的无限游戏
J
Java Code Geeks
罗磊的独立博客
雷峰网
雷峰网
G
Google Developers Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
爱范儿
爱范儿
B
Blog RSS Feed
腾讯CDC
Apple Machine Learning Research
Apple Machine Learning Research
D
Docker
Recent Announcements
Recent Announcements
T
Tailwind CSS Blog
博客园 - 聂微东
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Vercel News
Vercel News
小众软件
小众软件
人人都是产品经理
人人都是产品经理
云风的 BLOG
云风的 BLOG
IT之家
IT之家
Blog — PlanetScale
Blog — PlanetScale
I
InfoQ
S
SegmentFault 最新的问题

heise online News

Machine Learning mit Python – KI und Deep Learning in 5 Sessions erklärt Porsche-Chef Leiters plant umfassenden Konzernumbau Studie: KI bleibt oft im Testlauf stecken iX-Workshop: Grundlagen und Prinzipien eines modernen IT-Managements Missing Link: Aus für De-Mail – warum das „@“ das eingekringelte „e“ besiegte Top 10: Android Auto & Carplay nachrüsten – das beste Display fürs Auto im Test BOS-Funk: ETSI standardisiert Funk für Behörden Repair-Cafés jubeln: Bundestag beschließt Ökodesign-Reform für Nachhaltigkeit Google wehrt sich gegen Monopol-Urteil CERN-Rat beschließt Strategie-Update: FCC-ee soll LHC-Nachfolger werden Product Owner AI Day 2026: Konferenz und Workshop für KI im Produktmanagement Taskforce sieht keine Knappheit bei Kerosin Aus dem Weg! E-Scooter Navee UT5 Max mit Kuhfänger und brachialer Power im Test Krankenhaus-IT: Geldmangel und schlechte Prozesse gefährden Digitalisierung „The Boroughs“: Opa entdeckt Stranger Things iX-Workshop: Lokales Active Directory gegen Angriffe absichern Google Pics und Tiger-Selfies – die Fotonews der Woche 21/2025 Fitbit-App bekommt großes Update auf Version 5.0 und heißt jetzt Google Health Zwischen Wellen, Weite und Wissenschaft: Die Bilder der Woche 21 Sonnenenergie effizient speichern und nutzen | c’t uplink Cyberangriff auf Abrechnungsdienstleister betrifft viele Kliniken Lizenzstreit und Cloud-Zwang: Bambu Lab unter massivem Druck Vom Postweg ins BundID-Konto: Bundestag stimmt für digitales Führungszeugnis Windows 11 ist ein kompletter Verkehrsunfall Europol legt VPN-Dienst lahm TV-Deals zur WM: Die besten Fernseher von OLED bis XXL zum Tiefstpreis Nvidia will mit Vera-Prozessoren nach der CPU-Krone greifen Googles XR-Brillen auf der I/O: Project Aura & Prototyp ausprobiert Proxmox VE 9.2 mit Dynamic Load Balancer und Linux Kernel 7.0 Großstadt blockiert Überwachungssoftware Palantir
GPT-5.6: OpenAI verspricht mehr Leistung bei weniger Toke...
Niklas Engelking · 2026-06-27 · via heise online News

Unter strengen Auflagen der US-Regierung veröffentlicht OpenAI GPT-5.6, seine neue Generation von KI-Modellen. Es kann laut OpenAI in zahlreichen Benchmarks mit Anthropics Mythos 5 gleichziehen – und wurde wie Mythos auf Druck der US-Regierung hinweg für die breite Öffentlichkeit kassiert. GPT-5.6 soll verbesserte agentische Fähigkeiten in den Bereichen Programmierung, Biologie und Cybersicherheit aufweisen. Ebenfalls verbessert wurden demnach die Schutzmaßnahmen gegen Missbrauch.

GPT-5.6 umfasst das Balanced-Modell Terra für den Alltagsgebrauch, Luna, welches auf Schnelligkeit und Effizienz ausgelegt ist und Sol, das leistungsstärkste Modell als Flaggschiff. OpenAI nennt Ergebnisse diverser Benchmark-Tests, um die Stärken von GPT-5.6 zu untermauern. Beim Coding-Benchmark Terminal-Bench 2.1 überholen Sol und Sol Ultra mit Ergebnissen von 91,9 Prozent und 88,8 Prozent Mythos 5, das mit 88 Prozent abschneidet. Sol Ultra ist Sol mit einer neuen Funktion, die es erlaubt, weitere Subagenten hinzuziehen, um die Leistung von Sol noch weiter zu erhöhen.

Im biologischen Bereich nennt OpenAI den Benchmark GeneBench v1, vergleicht sich hier mit dem Vorgängermodell GPT 5.5. Beim Einsatz von 20.000 Tokens erzielt Sol rund 25 Prozent, während es bei GPT-5.5 nur 20 Prozent sind.

Bedeutend geringer soll zudem der Token-Verbrauch bei Cybersicherheits-Aufgaben sein. Beim Benchmark ExploitGym sollen Sol, Terra und Luna dieselbe Leistung wie Mythos Preview erreichen, bei nur rund einem Drittel des Token-Bedarfs. Welches Anthropic-Modell genau sich hier hinter Mythos Preview verbirgt, ist nicht ersichtlich

Auch die Schutzmaßnahmen gegen Missbrauch hat OpenAI nach eigenen Angaben überarbeitet. GPT‑5.6 soll verbotene Cyber-Unterstützung verweigern, auch wenn Nutzer versuchen, das Modell zu jailbreaken, also die Schutzmaßnahmen zu umgehen. Echtzeit-Klassifikatoren sollen auch die Antworten überwachen, während GPT-5.6 diese generiert.

Preislich sollen GPT-5.6-Modelle die Konkurrenz von Anthropic unterbieten: pro Million Input-Token 2,50 US-Dollar, 30 Dollar sind es beim Output. Bei gleicher Menge schlagen hier Fable 5 und Mythos 5 beide mit 10 Dollar für Input-Tokens und 50 Dollar für Output Tokens zu Buche.

(nen)