Menu

GPT-5.6 Les premières mesures sont arrivées ! Sniper de précision Mythos

Just now, Anthropic released the “Big Killer” that it had been working on for two months—Claude Fable 5etMythos 5C'est comme lancer une bombe.


Mettre directement la pression sur OpenAI.



En même temps, GPT-5.6 a également été divulgué.


OpenAI a commencé à tester son code interne la semaine dernière.kepleretkindleDeux nouveaux points de contrôle. La version Kindle-alpha a été sélectionnée comme candidat à la publication.



La version de test interne de GPT-5.6 commence à être largement testée par les développeurs étrangers et dans les cercles de diffusion de informations techniques. Le code, les versions proposées, ainsi que les données relatives à l'expérience utilisateur pendant l'utilisation du produit, ont été rendus publics.



Que ce soit la lutte pour une IPO ou la concurrence entre leurs modèles phares, les deux entreprises disent : « Je déposerai également ma demande, et toi aussi. » « Si tu lancez un nouveau modèle, je lancerai aussi un nouveau modèle. »


La pureté, c'est simplement se battre jusqu'au bout.


Mais la question est : peut vraiment GPT-5.6 battre Mythos ??



GPT-5.6 émerge...


Jusqu'à présent, OpenAI a affronté GPT-5.6 sans aucune annonce officielle, et il n'a pas encore été officiellement lancé.


Cependant, de nombreux internautes étrangers ont déjà révélé que les tests avec les sondes des « points de contrôle internes » ont été terminés.


Un point de contrôle (checkpoint) est une copie des paramètres d'un modèle enregistrée à un certain moment pendant son entraînement.


OpenAI dispose de nombreuses versions internes, qui sont comparées entre elles, et une version est choisie comme candidate à la publication (RC).


Depuis la semaine dernière, OpenAI teste en interne deux nouveaux points de contrôle, codés sous les noms de Kindle et Kepler. Parmi eux...kindle-alphaLa version candidate a été choisie pour la publication.



D'après les informations disponibles, l'upgrade le plus souvent mentionné dans cette sortie de données sur la technologie de perception du corps (sensory technology) est celui identifié par le token GPT-5.6.Générer l'interface utilisateur frontale。


Selon le netizen Pankaj Kumar, le Kindle a considérablement amélioré les capacités de génération de l'interface utilisateur (front-end) d'Alpha.Il est possible de produire des interfaces plus attrayantes directement, sans avoir besoin d'expressions suggestives complexes ou de compétences supplémentaires.。



De plus, ses capacités visuelles sont également très bonnes, avec de bons résultats dans les tâches de compréhension et de référence d'images, ainsi que des améliorations significatives en termes de raisonnement, d'encodage et de génération d'interfaces utilisateur (UI).


Voici les résultats mesurés par le internaute Chris avec le Kindle en mode “medium” :



Voici les résultats mesurés par un autre internaute précédemment sur la version non-réflexive de Joule :



On peut voir que le premier modèle est beaucoup plus sophistiqué.


Cependant, l'internaute Leo a utilisé le même prompt, Kepler et Kindle en mode “xhigh” pour ses mesures.


Par rapport à Kepler, il a été constaté que le Kindle était en train de régresser.



Eh bien... il est vraiment difficile d'évaluer cet effet.


Il pense même qu'OpenAI continuera probablement à améliorer le produit,et il n'est pas exclu qu'au final, le Kindle ne soit plus utilisé comme option de candidat.。


La dernière nouvelle est que le Kindle a été retiré de l'Arena, et un nouveau modèle est apparu.Levi。


Certains internautes ont supposé que “Levi” pourrait également être le nom de code d'une version interne de GPT-5.6, et ont comparé ses capacités frontales avec celles de GPT-5.5 :



Il est évident que la partie frontale de Levi est également très bonne, avec un style frais et sobre, et les détails sont bien gérés.


Cependant, certains internautes ont découvert que Levi pourrait provenir de Meta, et non de GPT-5.6.



Alors, peut vraiment GPT-5.6 battre Mythos ?


Le internaute mark_k affirme que GPT-5.6 « plusieurs agents ont battu les critères de codage de Mythoss ».



Mais ce qui est plus convaincant pour l’instant, c’est l’expérience réelle présentée par le internaute Leo. Il pense que la situation avec GPT-5.6 n’est pas optimiste :


Comparé à Kepler, le Kindle est un pas en arrière. Dans sa forme actuelle,Il est très facile de être vaincu par Mythos.。


En juin, les trois grandes familles organisent une représentation de « Fast and Furious ».


En juin, l'été est arrivé, et le monde des grands modèles s'est également animé.


Les dates de lancement des trois modèles phares de l'IA étrangers ont coïncidé : Fable 5, Gemini 3.5 Pro et GPT-5.6, créant une véritable compétition au rythme de la vie et de la mort.


De plus, ces modèles partagent les mêmes capacités : raisonnement, agents intelligents, codage et génération de contenu en ligne de front.


Ce qui est intéressant, c'est que, bien que ces trois entreprises aient mis tout en œuvre en juin,à ce jour, seule la société A a vraiment présenté ses résultats concrets.。


Gemini 3.5 Pro a été présenté lors de la conférence Google I/O le 19 mai, et se concentre sur le traitement de contextes de 2 millions de tokens ainsi que sur les capacités de raisonnement de type Deep Think.


Mais il n'est pas encore officiellement lancé ; les autorités ont prévu sa disponibilité pour juin.


GPT-5.6La nouvelle a été annoncée pour une publication plus tard dans le mois.


Cela ajoute également une tension à la situation d'OpenAI : l'adversaire a déjà publié les scores, et l'entreprise pourrait encore hésiter sur la version RC à soumettre.


Mais en dehors des tests de performance,TarificationC'est également un facteur important.


Le prix de Fable 5.Mythos 5 est fixé à Token10 en dollars américains, Token50 en dollars américains.


Environ deux fois plus que l'Opus actuel.


Si GPT-5.6 est à peu près au même niveau de performance que Mythos, voire avec une légère baisse, mais à un prix beaucoup plus abordable, il pourrait tout de même être intéressant pour augmenter l'utilisation réelle dans une ville.


Pour l'instant, OpenAI n'a pas fait d'annonce officielle, et le véritable duel ne pourra avoir lieu que lorsque la version finale de GPT-5.6 et Fable auront été testées de manière directe. ——


Il est très probable que nous connaîtrons le résultat ce mois-ci, alors restez à l'écoute !


Liens de référence :

[1]https://x.com/mark_k/status/2063922897341567488?s=20

[2]https://x.com/AiBattle_/status/2064078302394917157?s=20

[3]https://x.com/pankajkumar_dev/status/2063272015214354908?s=20

[4]https://x.com/synthwavedd/status/2063245096951160865?s=20

[5]https://x.com/ChrissGPT/status/2063135842906808579?s=20

[6]https://x.com/koltregaskes/status/2062806155139912164?s=20


L'auteur est de "Quantum Bit" et s'appelle "Ting Yu".

Cela vous a-t-il aidé ?

Support techniqueAssistance en ligne
侧栏
Haut de page
简体中文ZH-CNDefault繁體中文ZH-TWEnglishEN日本語JA한국어KOภาษาไทยTHTiếng ViệtVIBahasa IndonesiaIDEspañolESFrançaisFRDeutschDEРусскийRUPortuguêsPTItalianoITالعربيةAR