Menü

GPT-5.6 Die ersten Tests sind da! Scharfschütze Mythos

Vor kurzem hat Anthropic den „großen Killer“ veröffentlicht, der zwei Monate lang versteckt war –Claude Fable 5undMythos 5Es ist, als würde man eine Bombe werfen.


Jetzt drücken wir direkt Druck auf OpenAI aus.



Gleichzeitig wurde auch GPT-5.6 durchgesickert.


OpenAI hat seit letzter Woche interne Code-Tests durchgeführt.keplerundkindleZwei neue Kontrollpunkte. Kindle-Alpha wurde als Kandidat für die Veröffentlichung ausgewählt.



Die interne Testversion von GPT-5.6 beginnt sich in der Entwicklungszunft im Ausland sowie in den Kreisen, in denen Informationen durchsickern, schnell zu verbreiten. Der Code, die potenziellen Versionen sowie die Daten zur Erkennung von Bewegungen wurden bereits veröffentlicht.



Egal ob es um den Wettbewerb um eine IPO geht oder um das Zusammenstoßen der Flaggschiff-Modelle – beide Unternehmen sagen: „Ich reiche auch deinen Antrag ein“ und „Wenn du ein neues Modell veröffentlichst, werde ich auch ein neues Modell veröffentlichen.“


Reinheit bedeutet, dass es zu einem unkontrollierbaren Kampf kommt.


Aber die Frage ist: Kann GPT-5.6 wirklich Mythos besiegen???



GPT-5.6 taucht auf


Bis jetzt hat OpenAI bereits gegen... gekämpft.GPT-5.6Es gibt immer noch keine offiziellen Ankündigungen, und die Veröffentlichung ist noch nicht offiziell erfolgt.


Allerdings haben viele ausländische Internetnutzer noch nicht offiziell bekannt gegeben, dass die Tests mit den „internen Kontrollpunkt“-Proben abgeschlossen sind.


Ein sogenannter Checkpoint ist ein Snapshot der Parameter, der vom Modell zu einem bestimmten Zeitpunkt während des Trainingsprozesses gespeichert wird.


Innerhalb von OpenAI gibt es viele Versionen, die miteinander verglichen werden. Danach wird eine Version ausgewählt, die „ausreichend gut ist, um veröffentlicht zu werden“. Diese Version wird als Release Candidate (RC) bezeichnet.


Seit letzter Woche werden innerhalb von OpenAI zwei neue Checkpoints getestet, die die Codenamen „kindle“ und „kepler“ tragen.kindle-alphaDie alternative Version wurde ausgewählt und veröffentlicht.



Aus den veröffentlichten Informationen geht hervor, dass die am häufigsten erwähnte Verbesserung bei der Aktualisierung GPT-5.6 die folgende ist:Erstellung von Frontend-/UI-Elementen。


Laut dem Netizen Pankaj Kumar hat das Kindle die Frontend-Generierungsfähigkeit von Alpha erheblich verbessert.Es ist möglich, eine leistungsfähigere Benutzeroberfläche zu erstellen, ohne dass komplexe Hinweiswörter oder zusätzliche Fähigkeiten erforderlich sind.。



Darüber hinaus verfügt es auch über gute visuelle Fähigkeiten und zeigt sich in Aufgaben der Bildverständnis- und -referenzierung hervorragend. Es hat signifikante Verbesserungen in Bereichen wie Inferenz, Kodierung und UI-Generierung erzielt.


Das ist die Messung der Leistung des Kindle durch den Nutzer Chris, bei der die mittlere Einstellung verwendet wurde:



Das ist das Ergebnis einer anderen Person, das zuvor auf der nicht-rechnerischen Version von Joule gemessen wurde:



Der Erste ist viel raffinierter zu sehen.


Aber der Internetnutzer Leo verwendete denselben Prompt, Kepler und Kindle und maß die Werte jeweils in der höchsten Stufe („xhigh“).


Im Vergleich zu Kepler zeigt sich, dass das Kindle weiterhin rückläufig entwickelt.



Nun... diese Wirkung ist wirklich schwer zu bewerten.


Er geht sogar davon aus, dass OpenAI sehr wahrscheinlich weiterhin an seiner Entwicklung arbeiten wird, um die Leistung zu verbessern.Es wird nicht ausgeschlossen, dass Kindle letztendlich als einer der möglichen Optionen verworfen wird.。


Die neuesten Nachrichten besagen, dass das Kindle aus dem Arena-Programm entfernt wurde und ein neues Modell auf den Markt gekommen ist.Levi。


Einige Nutzer vermuten, dass Levi auch möglicherweise…GPT-5.6Die Codenamen für die internen Versionen und deren Verbindung mitGPT-5.5Die Frontend-Fähigkeiten wurden verglichen:



Daraus geht hervor, dass auch die Frontend-Technologie von Levi ziemlich gut ist – der Stil ist frisch und schlicht, mit einem Hauch von Eleganz, und die Details werden sehr sorgfältig behandelt.


Aber einige Nutzer haben festgestellt, dass Levi möglicherweise von Meta stammt und nicht von GPT-5.6.



Also, kann GPT-5.6 wirklich Mythos besiegen?


Der Nutzer mark_k behauptet, dass GPT-5.6 „mehrere agente die Coding-Benchmarks von Mythoss besiegt haben“.



Aber derzeit überzeugender ist die tatsächliche Messung des Nutzers Leo, die zuvor gezeigt wurde. Er ist der Meinung, dass die Situation mit GPT-5.6 nicht optimistisch ist:


Im Vergleich zu Kepler ist der Kindle ein Rückschritt. In seiner derzeitigen Form…Es ist sehr einfach, von Mythos besiegt zu werden.。


Im Juni führen die drei führenden Familien das Stück „Speed & Passion“ auf.


Im Juni ist der Sommer gekommen, und die Welt der großen Modelle wird auch immer heißer.


Die Veröffentlichung der drei führenden AI-Modelle aus dem Ausland fiel zeitlich zusammen: Fable 5, Gemini 3.5 Pro und GPT-5.6, was zu einem wahren „Wettrennen um Leben und Tod“ führte.


Und es werden die gleichen Fähigkeiten genutzt: Schlussfolgerung, Agenten, Kodierung, Frontend-Generierung.


Interessanterweise haben alle drei Unternehmen im Juni die Knotenpunkte dort platziert, aberBis jetzt hat nur Unternehmen A seine Arbeiten tatsächlich eingereicht.。


Gemini 3.5 Pro wurde auf der Google I/O-Konferenz am 19. Mai vorgestellt und konzentriert sich auf den Umgang mit 2 Millionen Tokens im Kontext sowie auf die Deep Think-Logik.


Aber es ist noch nicht offiziell veröffentlicht; die offizielle Veröffentlichung ist für Juni geplant.


GPT-5.6, die Nachricht wurde für eine Veröffentlichung später in diesem Monat angekündigt.


Das fügt auch der Situation bei OpenAI eine zusätzliche Spannung hinzu: Der Konkurrent hat bereits die Ergebnisse veröffentlicht, und innerhalb von OpenAI wird wahrscheinlich noch darüber diskutiert, welche RC-Version übergeben werden soll.


Aber abgesehen von den Benchmarks…PreisgestaltungEs ist auch ein wichtiger Faktor.


Fable 5.Mythos5 ist ein einheitlicher Preis für Token10 in US-Dollar, Token50 in US-Dollar.


Etwa doppelt so viel wie das aktuelle Opus.


Wenn GPT-5.6 in den Leistungsmerkmalen mit Mythos gleichzieht oder sogar leicht nachlässt, aber viel günstiger ist, dann besteht immer noch die Möglichkeit, dass es in der tatsächlichen Nutzung einen Stadtbezirk zurückgewinnen kann~


Bislang hat OpenAI keine offizielle Ankündigung gemacht; das echte Duell wird erst dann stattfinden, wenn die finale Version von GPT-5.6 und Fable offiziell miteinander verglichen werden.


Es wird wahrscheinlich in diesem Monat Klarheit herrschen – bleiben Sie gespannt!


Referenzlinks:

[1]https://x.com/mark_k/status/2063922897341567488?s=20

[2]https://x.com/AiBattle_/status/2064078302394917157?s=20

[3]https://x.com/pankajkumar_dev/status/2063272015214354908?s=20

[4]https://x.com/synthwavedd/status/2063245096951160865?s=20

[5]https://x.com/ChrissGPT/status/2063135842906808579?s=20

[6]https://x.com/koltregaskes/status/2062806155139912164?s=20


Der Autor stammt von „Quantum Bit“ und heißt „Ting Yu“.

War das hilfreich?

Technischer SupportLive-Support
侧栏
Nach oben
简体中文ZH-CNDefault繁體中文ZH-TWEnglishEN日本語JA한국어KOภาษาไทยTHTiếng ViệtVIBahasa IndonesiaIDEspañolESFrançaisFRDeutschDEРусскийRUPortuguêsPTItalianoITالعربيةAR