GPT-5.6 Первые испытания пришли!Точный снайпер Mythos
Только что компания Anthropic выпустила свой главный продукт, который находился в разработке в течение двух месяцев —Claude Fable 5иMythos 5Это было похоже на бросок бомбы.
Сейчас нужно напрямую оказать давление на OpenAI.

В то же время был также утечен GPT-5.6.
OpenAI начал тестирование своего внутреннего кода на прошлой неделе.keplerиkindleДва новых контрольных пункта. Kindle-alpha был выбран в качестве кандидата на выпуск.

Внутренняя тестовая версия GPT-5.6 начала активно использоваться зарубежными разработчиками и сообществами, занимающимися утечкой информации. Код, предварительные версии продукта, а также данные о работе системы были распространены среди пользователей.

Будь то борьба за IPO или столкновение флагманских моделей, обе компании говорят: «Я также подам заявку на IPO, а ты выпустишь новую модель, я тоже выпущу новую модель».
Чистота означает, что битва идет без остановки.
Но вопрос в том, сможет ли GPT-5.6 действительно победить Mythos??

GPT-5.6 появился на поверхность.
На данный момент OpenAI продолжает бороться с GPT-5.6, и официальных заявлений от них нет; версия все еще не была официально выпущена.
Тем не менее, многие зарубежные пользователи интернета уже узнали, что тестирование «внутренних контрольных точек» (internal checkpoints) завершено.
Так называемые контрольные точки (checkpoints) — это снимки параметров модели, сохраненные в определенный момент в процессе обучения.
В OpenAI существует множество таких снимков, которые сравниваются между собой, и затем из них выбирается версия, считающаяся достаточно хорошей для публикации; такая версия называется кандидатом на выпуск (release candidate, RC).
Начиная с прошлой недели, внутри OpenAI проводятся тестирования двух новых точек контроля (чекпойнтов), кодовые названия которых — Kindle и Kepler.kindle-alphaКандидатская версия была выбрана для публикации.

Судя по полученной информации о сенсорных данных, самым часто упоминаемым обновлением на этот раз является GPT-5.6.Генерация фронтенд/Интерфейса пользователя。
По словам пользователя Панкая Кумара, Kindle значительно улучшил возможности генерации пользовательского интерфейса (фронтенда) в рамках проекта Alpha.Можно напрямую создавать более удобный пользовательский интерфейс, без использования сложных подсказок или дополнительных навыков.。

Кроме того, его визуальные возможности также очень хороши: он хорошо справляется с задачами понимания и использования изображений, а также демонстрирует значительные улучшения в области рассуждений, кодирования и генерации пользовательского интерфейса (UI).
Это результаты измерений, проведенных пользователем интернета Chris при использовании режима работы Kindle на средней мощности:

Это результаты, полученные другим пользователем ранее на неразумственной версии Joule:

Как видно, первый вариант намного изысканнее.
Но пользователь сети Leo взял тот же промпт, Kepler и Kindle и провел измерения на высоком уровне (xhigh).
По сравнению с Kepler, было обнаружено, что Kindle продолжает ухудшаться в своих характеристиках.

Эм... Оценить такой эффект действительно сложно.
Он даже считает, что OpenAI, скорее всего, продолжит совершенствовать свои технологии.Не исключается возможность в конечном итоге отказаться от использования Kindle в качестве одного из вариантов реализации.。
Последние новости гласят, что Kindle был удален из линейки Arena, и появилась новая модель.Levi。
Некоторые пользователи предполагают, что Levi также может быть кодовым названием внутренней версии GPT-5.6, и сравнивают его с функциональными возможностями фронтенда GPT-5.5:

Из этого видно, что фронтенд Levii тоже довольно хорош: стиль свежий и простой, с оттенком высококлассности, а обработка деталей выполнена на высоком уровне.
Но некоторые пользователи интернета обнаружили, что Леви, возможно, происходит из Meta, а не из GPT-5.6.

Так сможет ли GPT-5.6 победить Mythos?
Пользователь интернета mark_k утверждает, что GPT-5.6 «несколько агентов превзошли критерии производительности кодирования Mythoss».

Однако более убедительными являются результаты реальных тестов, представленные пользователем сети Leo. Он считает, что ситуация с использованием параметра GPT-5.6 не выглядит оптимистично:
По сравнению с Kepler, Kindle представляет собой шаг назад. В своем нынешнем виде...Легко может быть побежден Mythos。
В июне три ведущих семьи представили спектакль «Скорость и страсть»
Июнь наступил, лето пришло, и среда больших моделей тоже оживилась.
Время выпуска трех ведущих моделей искусственного интеллекта из-за рубежа совпало: Fable 5, Gemini 3.5 Pro и GPT-5.6, что привело к появлению ситуации, которую можно описать как «гонку на выживание».
И используются те же самые инструменты и технологии: логическое мышление, создание агентов (интеллектуальных систем), кодирование, а также генерация пользовательского интерфейса на переднем энде (frontend generation).
Интересно то, что, хотя все три компании в июне сосредоточили свои усилия на этом аспекте,На данный момент только компания A представила свои работы.。
Gemini 3.5 Pro был представлен на конференции Google I/O 19 мая и ориентирован на обработку контекста из 2 миллионов токенов, а также на алгоритмы рассуждения Deep Think.
Но оно еще не было официально запущено; официальная дата запуска назначена на июнь.
Сообщение о том, что GPT-5.6 будет выпущено, поступило позже в этом месяце.
Это также добавляет дополнительное напряжение ситуации с OpenAI: их соперники уже опубликовали свои результаты, и внутри компании, возможно, все еще идут дебаты о том, какую версию программы (RC) следует представить.
Но кроме тестирования производительности,ЦенообразованиеЭто также важный фактор.
Фиксированная цена Fable 5.Mythos 5 составляет Token10 в долларах США и Token50 в долларах США.
Примерно в два раза больше, чем у существующего Opus.
Если GPT-5.6 будет иметь такие же или даже немного худшие характеристики, чем Mythos, но по цене значительно дешевле, то он все равно может повысить свою популярность среди пользователей и завоевать рынок в определенном городе.
На данный момент у OpenAI нет официального объявления, и настоящее соревнование можно будет назвать таковым только в тот момент, когда будет выпущена официальная версия GPT-5.6 и Fable получат непосредственные результаты тестирования.
В этом месяце, скорее всего, все станет ясно, ждите с нетерпением~
Ссылки для справки:
[1]https://x.com/mark_k/status/2063922897341567488?s=20
[2]https://x.com/AiBattle_/status/2064078302394917157?s=20
[3]https://x.com/pankajkumar_dev/status/2063272015214354908?s=20
[4]https://x.com/synthwavedd/status/2063245096951160865?s=20
[5]https://x.com/ChrissGPT/status/2063135842906808579?s=20
[6]https://x.com/koltregaskes/status/2062806155139912164?s=20
Автор пришел из проекта "Квантовые Биты" под псевдонимом "Тин Юй".
Ссылка на статью:https://airai.cc/ru/ai-news/8/
Было ли это полезно?