Клод Фейбл 5 слова утечки, 6 часов эффекта проверен, действительно убивает сумасшедших?
Fable 5 только что вышел на рынок, и уже сразу же были утечки системных сигналов (текстов, используемых системой для общения с пользователем):

После прочтения этого подсказочного текста есть несколько ключевых моментов:
- Во-первых, Fable добавил API для постоянного хранения данных в Artifact (
window.storage). Artifact представляет собой уникальный контент, генерируемый кодом Claude, такой как HTML-страницы, React-компоненты и т. д. Ранее данные Artifact нельзя было сохранить, и они использовались скорее как одноразовые демо-версии. Теперь данные могут сохраняться между сессиями, что позволяет создавать инструменты с функцией “памяти”, такие как рейтинги, системы отметки времени, дневники и т. д.
- Во-вторых, Fable улучшила полную логику коннектора MCP App. Если вы хотите подключиться к внешним сервисам (заказы, такси, музыка и т. д.), Fable сначала проверит каталог доступных сервисов, а затем предложит вам выбор для подтверждения. Особенно для сервисов, за которые требуется оплата, предусмотрены детальные правила активации (opt-in).
А также:
- В-третьих, когда система Fable обнаруживает требования, связанные с кибербезопасностью, биохимией и процессами перегонки, она автоматически передает ответ на обработку второстепенной модели Opus 4.8 и уведомляет пользователя о необходимости снижения уровня обслуживания.
- Во-четвертых, в Fable появилась функция long_conversation_reminder (напоминание о длинном разговоре). Когда разговор затягивается, система Fable добавляет соответствующее напоминание в конец информации пользователя, чтобы модель не забывала о первоначальном содержании разговора.
Ссылка на репозиторий:
https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/CLAUDE-FABLE-5.md
Хотя снижение качества продукта Mythos было ожидаемым, из сообщений этой системы все же видно, что компания Anthropic придает большое значение безопасности.
Стоит отметить, что в положениях Fable, касающихся поведенческих норм, раздел, посвященный психическому здоровью, занимает довольно большое место. Учитывая судебные иски о самоубийствах, связанных с чат-ботами, возникшие за последние год-два, несложно понять, почему этот раздел описан так подробно...
Конец оригинального текста:

Перевод гласит:
Клод заботится о физическом и психическом здоровье людей и стремится не поощрять или способствовать саморазрушающему поведению, такому как зависимости, самоповреждение, нарушения питания или здоровья при занятиях спортом, а также крайне негативный самодиалог или самокритика.
Даже если пользователь просит об этом напрямую, Клод может воздержаться от создания контента, который может способствовать или усилить саморазрушение.
При обсуждении с людьми, у которых есть мысли о самоубийстве или импульсы к самоповреждению, таких тем, как «ограничение опасных действий» или «планы безопасности», Клод не называет конкретных имен, не перечисляет деталей и не описывает способы действий. Даже если речь идет о том, чтобы предостеречь человека от опасных ситуаций, Клод не делает этого напрямо, поскольку упоминание подобных вещей может случайно спровоцировать у него негативные реакции.
Давайте рассмотрим результаты фактических тестов игры Fable 5.
Это демонстрация, созданная пользователем с использованием функции копирования из Fable 5 в стиле The Elder Scrolls:

Fable использует 3D-сцену леса, созданную с помощью ThreeJ:

Имеется модель пространства с 5000 объектами:

Демонстрация нью-йоркского небоскребов:

Готический город поглощен волнами:

Интернет-пользователь Виктор Таэлин взял реальный проект для тестирования.

HVM5Это низкоуровневая система, связанная с высокопроизводительными вычислениями. Он раньше ею пользовался. 32GPT-5Агент работал примерно 20 часов, и хотя скорость увеличилась вдвое, качество кода ухудшилось из-за его расширения. Позже ему были разрешены использовать стандарты Opus 4.8.GPT-5.5Оптимизация заняла 8 часов; скорость работы алгоритма Opus увеличилась на 6% до 34%. Результаты работы алгоритма GPT оказались ещё лучше, но файлы, полученные с использованием GPT, нельзя использовать.

В результате Fable 5 справился с задачей за 2 часа: только на одном бенчмарке произошло улучшение на 1770%, а на остальных 4 бенчмарках показатели превысили средний уровень на 100% + 22%.
Первая реакция пользователей сети была недоверием; они сомневались, не является ли этот бенчмарк “жестко закодированным” (то есть неизменным во время выполнения программы), так как ранее они уже сталкивались с подобными проблемами при использовании инструментов вроде GPT.

После прочтения объяснений он понял, что направление оптимизации Fable действительно разумно.
Поскольку компонент HVM5 удаляет множество ненужных ветвей кода во время обработки узлов динамического сопоставления шаблонов, это приводит к тому, что они попадают в процесс утилизации (выброса памяти), что тратит много времени. Ранее пользователи оптимизировали только процесс сопоставления статических шаблонов, не затрагивая динамические случаи. Fable обнаружил эту проблему, поэтому результаты тестов стали слишком завышенными (неправдивыми).
Это анализ причин ошибки HVM5, предоставленный Fable 5:

Турецкий пользователь сети Аличан Кираж провел ряд сравнительных тестов между Fable 5 и GPT 5.5.
Его вывод таков: Fable 5 потребовал значительных затрат — 360,55 долларов; в то время как GPT-5.5 стоил всего 6 долларов. Однако, если судить по деталям оптимизации, Fable 5 действительно добился более глубоких, серьезных улучшений, более соответствующих подходу инженеров, занимающихся производительностью программного обеспечения.

Это его выводы по тестированию:

Согласно реальным тестам с использованием стороннего программного инструмента Augment Code, программировочные возможности Fable 5 действительно очень сильны.
Было проведено тестирование 489 программных задач, и Fable 5 показал значительно лучшие результаты по общему показателю и точности выполнения задач: общий балл Fable 5 вырос на 0.224, а точность — на 0.191.

Но есть и примеры, когда результаты тестирования оказались разочаровывающими. Интернет-пользователь Ryan R. Hughes представил большой патч (PR), состоящий из 74 файлов, на рассмотрение команды Fable 5. Процесс проверки занял более 34 минут и потребовал 42% ресурсов системы Claude Code в течение 5 часов; в итоге было выявлено всего 16 ошибок.

Подобные примеры встречаются довольно часто; Fable 5, к сожалению, довольно дорогая игра.

Некоторые считают, что, согласно результатам тестирования, Fable 5 имеет слабые возможности по анализу длинных текстов:

Большинство негативных отзывов касаются процедуры деградации модели:

В настоящее время стоимость API для Fable 5 составляет 10 долларов США за каждый миллион входных токенов и 50 долларов США за каждый миллион выходных токенов.

Если сравнивать в горизонтальном порядке, эта цена примерно в два раза выше, чем у модели Opus 4.8, и более чем в три раза выше, чем у модели Sonnet 4.6. Фактическая стоимость выполнения одного сложного рабочего процесса значительно превышает стоимость любой предыдущей версии модели Claude.
Кроме того, увеличена и чувствительность системы: в целом подход к защите стал более консервативным; предпочтение отдается предотвращению ошибочных повреждений, даже если это означает некоторую потерю стабильности.
Для решения проблемы чрезмерно высоких затрат я собрал результаты практических тестов пользователей интернета, которые показывают, что этот подход не только помогает сэкономить деньги, но и обеспечивает хорошие результаты. Рекомендуется использовать смешанный подход к моделям:
В IDE, поддерживающих смешанные модели, таких как Cursor, различные модели могут использоваться на платформе поэтапно:
Первый этап: Проверка кода и предварительный анализ проекта с целью подготовки контекста и понимания структуры проекта. Можно использовать один из следующих инструментов: GPT-5.5, MiniMax M3, Kimi K2.6 или Composer 2.5.
Второй этап: Разработка плана проекта с использованием инструментов GPT-5.5 Very High или Opus 4.8 для подготовки плана проекта.
Третий этап: Анализ использования плана проекта. Используйте Fable 5 для проверки плана проекта и выявления возможных ошибок в нем. Если необходимо внести изменения в план, используйте GPT-5.5 с уровнем очень высокой важности (Very High).
Четвертый этап: Реализация и использование плана проекта с использованием инструментов MiniMax M3, DeepSeek V4, Max, Composer 2.5 или Sonnet 4.6.
Пятый этап: окончательный анализ. С использованием кода GPT-5.5 проводится проверка окончательных результатов анализа кода, чтобы убедиться, что реализация соответствует первоначальному плану.
Использование самых мощных средств в самом подходящем месте — вот как правильно начать игру Fable 5.
Эффект от убийства сумасшедшего персонажа в Claude Fable 5 оценивается по-разному: добрые люди видят одно, мудрые — другое.
Но с его использованием скорость потребления токенов становится очень ясной… Просто сумасшедшая скорость!
Статья взята из WeChat-аккаунта “JackCui”, автора “JackCui”.
Ссылка на статью:https://airai.cc/ru/%E6%9C%AA%E5%91%BD%E5%90%8D/7/
Было ли это полезно?