Меню

GPT-5.6 Первые испытания пришли!Точный снайпер Mythos

Только что компания Anthropic выпустила свой главный продукт, который находился в разработке в течение двух месяцев —Claude Fable 5иMythos 5Это было похоже на бросок бомбы.


Сейчас нужно напрямую оказать давление на OpenAI.



В то же время был также утечен GPT-5.6.


OpenAI начал тестирование своего внутреннего кода на прошлой неделе.keplerиkindleДва новых контрольных пункта. Kindle-alpha был выбран в качестве кандидата на выпуск.



Внутренняя тестовая версия GPT-5.6 начала активно использоваться зарубежными разработчиками и сообществами, занимающимися утечкой информации. Код, предварительные версии продукта, а также данные о работе системы были распространены среди пользователей.



Будь то борьба за IPO или столкновение флагманских моделей, обе компании говорят: «Я также подам заявку на IPO, а ты выпустишь новую модель, я тоже выпущу новую модель».


Чистота означает, что битва идет без остановки.


Но вопрос в том, сможет ли GPT-5.6 действительно победить Mythos??



GPT-5.6 появился на поверхность.


На данный момент OpenAI продолжает бороться с GPT-5.6, и официальных заявлений от них нет; версия все еще не была официально выпущена.


Тем не менее, многие зарубежные пользователи интернета уже узнали, что тестирование «внутренних контрольных точек» (internal checkpoints) завершено.


Так называемые контрольные точки (checkpoints) — это снимки параметров модели, сохраненные в определенный момент в процессе обучения.


В OpenAI существует множество таких снимков, которые сравниваются между собой, и затем из них выбирается версия, считающаяся достаточно хорошей для публикации; такая версия называется кандидатом на выпуск (release candidate, RC).


Начиная с прошлой недели, внутри OpenAI проводятся тестирования двух новых точек контроля (чекпойнтов), кодовые названия которых — Kindle и Kepler.kindle-alphaКандидатская версия была выбрана для публикации.



Судя по полученной информации о сенсорных данных, самым часто упоминаемым обновлением на этот раз является GPT-5.6.Генерация фронтенд/Интерфейса пользователя。


По словам пользователя Панкая Кумара, Kindle значительно улучшил возможности генерации пользовательского интерфейса (фронтенда) в рамках проекта Alpha.Можно напрямую создавать более удобный пользовательский интерфейс, без использования сложных подсказок или дополнительных навыков.。



Кроме того, его визуальные возможности также очень хороши: он хорошо справляется с задачами понимания и использования изображений, а также демонстрирует значительные улучшения в области рассуждений, кодирования и генерации пользовательского интерфейса (UI).


Это результаты измерений, проведенных пользователем интернета Chris при использовании режима работы Kindle на средней мощности:



Это результаты, полученные другим пользователем ранее на неразумственной версии Joule:



Как видно, первый вариант намного изысканнее.


Но пользователь сети Leo взял тот же промпт, Kepler и Kindle и провел измерения на высоком уровне (xhigh).


По сравнению с Kepler, было обнаружено, что Kindle продолжает ухудшаться в своих характеристиках.



Эм... Оценить такой эффект действительно сложно.


Он даже считает, что OpenAI, скорее всего, продолжит совершенствовать свои технологии.Не исключается возможность в конечном итоге отказаться от использования Kindle в качестве одного из вариантов реализации.。


Последние новости гласят, что Kindle был удален из линейки Arena, и появилась новая модель.Levi。


Некоторые пользователи предполагают, что Levi также может быть кодовым названием внутренней версии GPT-5.6, и сравнивают его с функциональными возможностями фронтенда GPT-5.5:



Из этого видно, что фронтенд Levii тоже довольно хорош: стиль свежий и простой, с оттенком высококлассности, а обработка деталей выполнена на высоком уровне.


Но некоторые пользователи интернета обнаружили, что Леви, возможно, происходит из Meta, а не из GPT-5.6.



Так сможет ли GPT-5.6 победить Mythos?


Пользователь интернета mark_k утверждает, что GPT-5.6 «несколько агентов превзошли критерии производительности кодирования Mythoss».



Однако более убедительными являются результаты реальных тестов, представленные пользователем сети Leo. Он считает, что ситуация с использованием параметра GPT-5.6 не выглядит оптимистично:


По сравнению с Kepler, Kindle представляет собой шаг назад. В своем нынешнем виде...Легко может быть побежден Mythos。


В июне три ведущих семьи представили спектакль «Скорость и страсть»


Июнь наступил, лето пришло, и среда больших моделей тоже оживилась.


Время выпуска трех ведущих моделей искусственного интеллекта из-за рубежа совпало: Fable 5, Gemini 3.5 Pro и GPT-5.6, что привело к появлению ситуации, которую можно описать как «гонку на выживание».


И используются те же самые инструменты и технологии: логическое мышление, создание агентов (интеллектуальных систем), кодирование, а также генерация пользовательского интерфейса на переднем энде (frontend generation).


Интересно то, что, хотя все три компании в июне сосредоточили свои усилия на этом аспекте,На данный момент только компания A представила свои работы.。


Gemini 3.5 Pro был представлен на конференции Google I/O 19 мая и ориентирован на обработку контекста из 2 миллионов токенов, а также на алгоритмы рассуждения Deep Think.


Но оно еще не было официально запущено; официальная дата запуска назначена на июнь.


Сообщение о том, что GPT-5.6 будет выпущено, поступило позже в этом месяце.


Это также добавляет дополнительное напряжение ситуации с OpenAI: их соперники уже опубликовали свои результаты, и внутри компании, возможно, все еще идут дебаты о том, какую версию программы (RC) следует представить.


Но кроме тестирования производительности,ЦенообразованиеЭто также важный фактор.


Фиксированная цена Fable 5.Mythos 5 составляет Token10 в долларах США и Token50 в долларах США.


Примерно в два раза больше, чем у существующего Opus.


Если GPT-5.6 будет иметь такие же или даже немного худшие характеристики, чем Mythos, но по цене значительно дешевле, то он все равно может повысить свою популярность среди пользователей и завоевать рынок в определенном городе.


На данный момент у OpenAI нет официального объявления, и настоящее соревнование можно будет назвать таковым только в тот момент, когда будет выпущена официальная версия GPT-5.6 и Fable получат непосредственные результаты тестирования.


В этом месяце, скорее всего, все станет ясно, ждите с нетерпением~


Ссылки для справки:

[1]https://x.com/mark_k/status/2063922897341567488?s=20

[2]https://x.com/AiBattle_/status/2064078302394917157?s=20

[3]https://x.com/pankajkumar_dev/status/2063272015214354908?s=20

[4]https://x.com/synthwavedd/status/2063245096951160865?s=20

[5]https://x.com/ChrissGPT/status/2063135842906808579?s=20

[6]https://x.com/koltregaskes/status/2062806155139912164?s=20


Автор пришел из проекта "Квантовые Биты" под псевдонимом "Тин Юй".

Было ли это полезно?

Техническая поддержкаОнлайн-поддержка
侧栏
Наверх
简体中文ZH-CNDefault繁體中文ZH-TWEnglishEN日本語JA한국어KOภาษาไทยTHTiếng ViệtVIBahasa IndonesiaIDEspañolESFrançaisFRDeutschDEРусскийRUPortuguêsPTItalianoITالعربيةAR