Claude Fable 5 프롬프트 단어 유출, 6 시간 효과 실측, 정말 죽여 미친?
Fable 5가 막 출시되었는데, 시스템 힌트 문구가 이미 유출되었습니다:

이 힌트 단어를 보면 몇 가지 중요한 점이 있습니다:
- 첫째, Fable은 Artifact에 지속적인 저장 기능을 제공하는 API(
window.storage)를 추가했습니다. Artifact란 Claude 코드로 생성된 고유한 콘텐츠, 예를 들어 HTML 페이지나 React 컴포넌트 등을 말합니다. 이전에는 Artifact 데이터를 저장할 수 없어서 일회성 데모와 같았습니다. 이제는 데이터를 세션 간에 저장할 수 있게 되었으며, 순위표, 출석 기록기, 일기와 같이 “기억을 가진” 작은 도구들을 지원할 수 있게 되었습니다.
- 둘째, Fable은 MCP App 커넥터의 전체 로직을 개선했습니다. 외부 서비스(주문, 택시, 음악 등)에 연결하고 싶다면, Fable은 먼저 사용 가능한 서비스 목록을 확인한 다음 해당 옵션을 사용자에게 제시하여 확인을 받습니다. 특히 비용이 발생하는 서비스의 경우, Fable은 상세한 서비스 이용 동의 절차를 제공합니다.
그리고:
- 셋째, Fable이 네트워크 보안, 생화학, 증류와 관련된 요구사항을 인식하면, 자동으로 두 번째로 강력한 모델인 Opus 4.8에 응답을 처리하도록 전달하고, 사용자에게 업그레이드를 하지 않을 것을 알립니다.
- 네 번째로, Fable에는 `long_conversation_reminder`라는 새로운 기능이 추가되었습니다. 대화가 길어지면, Fable은 사용자 정보의 끝에 알림을 추가하여 모델이 이전의 대화 내용을 잊지 않도록 상기시킵니다. 이는 대화가 너무 오래 지속되었기 때문입니다.
저장소 링크:
https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/CLAUDE-FABLE-5.md
비록 Mythos가 예상되었던 민간용 업그레이드 버전이었지만, 이 시스템의 안내 메시지에서도 Anthropic이 보안에 매우 신경을 쓰고 있음을 알 수 있습니다.
언급할 만한 점은, Fable의 행동 규정에서 정신 건강에 관한 내용이 상당한 비중을 차지하고 있다는 것입니다. 지난 1~2년간 채팅 로봇과 관련된 자살 소송들을 고려하면, 이 부분이 왜 이렇게 상세하게 작성되었는지 이해하기 어렵지 않습니다...
원문은 비어 있습니다. 제공된 내용이 없으므로 번역할 수 없습니다.

번역은 다음과 같다:
클로드는 사람들의 신체적, 정신적 건강에 관심을 가지고 있으며, 중독, 자해, 식이나 운동 장애/불건강한 습관과 같은 자기파괴적인 행동을 조장하거나 장려하지 않으려고 노력합니다. 또한, 매우 부정적인 자기 대화나 자기 비판도 피하려고 합니다.
"""사용자가 직접 요청하더라도, 클로드는 자기파괴를 지원하거나 강화할 수 있는 콘텐츠를 생성하는 것을 피할 수 있습니다."
자살 생각이나 자해 충동이 있는 사람과 “위험한 행동을 제한하는 방법”이나 “안전 계획”에 대해 이야기할 때, 클로드는 구체적인 이름을 언급하거나 목록을 만들거나 상세히 설명하지 않습니다. 사용자에게 무엇을 피해야 하는지 알려주기 위해서라도, 클로드는 그런 내용을 직접 말하지 않습니다. 왜냐하면 그런 것들을 언급하는 것이 실수로 사용자에게 부정적인 영향을 줄 수 있기 때문입니다.
그럼 Fable 5의 실제 테스트 결과를 살펴보겠습니다.
이것은 네티즌이 Fable 5에서 고대 롤플레잉 게임의 데모를 복제한 것입니다:

Fable은 ThreeJ가 구축한 3D 숲 장면을 호출합니다:

5000개의 물체를 가진 공간 시뮬레이션을 보유하고 있습니다:

뉴욕 스카이라인 데모:

고딕 도시가 파도에 삼켜졌다:

x 네티즌 Victor Taelin은 실제 프로젝트를 가져와서 테스트를 진행했습니다.

HVM5 이것은 고성능 컴퓨팅과 관련된 기반 시스템입니다. 이전에도 사용된 적이 있습니다. 32개의 GPT-5 에이전트가 약 20시간 동안 실행되었는데, 최대 2배의 속도 향상은 있었지만 코드가 확장되면서 품질이 저하되었습니다. 그 후, Opus 4.8과 GPT-5.5를 사용하여 8시간 동안 최적화를 거쳤습니다. Opus를 사용하면 6%에서 34%의 효과적인 속도 향상이 있었지만, 파일은 사용할 수 없었습니다.

결과적으로, Fable 5는 단 2시간 만에 달성했으며, 단 하나의 벤치마크에서는 1770%의 향상을 보였고, 나머지 4개의 벤치마크에서는 평균보다 100% 이상 22%의 증가를 기록했습니다.
네티즌들의 첫 반응은 믿기 어렵다는 것이었으며, 이전에 GPT와 같은 기술로 인해 비슷한 문제가 발생한 적이 있었기 때문에 이번 벤치마크가 “하드코딩된” 것이 아닌지 의심했습니다.

설명을 읽고 나서, 그는 Fable의 최적화 방향이 실제로 타당하다는 것을 깨달았습니다.
HVM5가 동적 패턴 매칭 노드를 처리할 때 많은 불필요한 분기들도 가비지 수집 대상이 되어 많은 시간이 낭비되었습니다. 이전에는 정적 매칭만 최적화되었고 동적 매칭은 최적화되지 않았습니다. Fable이 이 문제를 발견하여 테스트 결과가 매우 과장되게 나타났습니다.
이것은 Fable 5에서 제공한 HVM5 버그의 근본 원인 분석입니다:

터키의 네티즌 Alican Kiraz는 Fable 5와 GPT 5.5를 비교하는 일련의 테스트를 진행했습니다.
그의 결론은, Fable 5를 실행하는 데 많은 돈이 들었다는 것입니다. 360.55달러였죠; 반면에 GPT-5.5는 단지 6달러만 들었습니다. 하지만 세부적인 최적화 측면에서 보면, Fable 5가 더 근본적이고, 더 하드코어적이며, 성능 엔지니어의 사고방식에 더 가까운 최적화를 이루었다고 합니다.

이것은 그의 테스트 결론입니다:

"""제3자 프로그래밍 도구인 Augment Code의 실제 작업 테스트에 따르면, Fable 5의 프로그래밍 능력이 매우 뛰어납니다."""
테스트에서 총 489개의 프로그래밍 과제가 함께 실행되었으며, Fable 5는 전반적인 성능과 정확도에서 두드러진 우위를 보였습니다. 총점은 +0.224, 정확도는 +0.191 증가했습니다.

하지만 실제 테스트 결과가 실망스러운 사례도 있습니다. 네티즌 Ryan R. Hughes는 74개의 파일로 구성된 대규모 PR을 Fable 5에 제출했는데, 처리에 34분이 걸렸으며 Claude Code 세션의 42%의 리소스를 소모한 후에 겨우 16개의 오류만 발견되었습니다.

이런 예시는 드문 일이 아닙니다. Fable 5는 조금 너무 비쌉니다.

일부 사람들은 실제 테스트를 통해 Fable 5의 긴 텍스트 처리 능력이 약하다고 생각합니다:

더 많은 나쁜 평가들은 모델 업그레이드 작업에 집중되어 있습니다:

현재 Fable 5의 API 가격은 입력 토큰 1백만 개당 10달러, 출력 토큰 1백만 개당 50달러입니다.

가로로 비교해보면, 이 가격은 Opus 4.8의 약 두 배이며 Sonnet 4.6의 세 배가 넘습니다. 단일 복잡한 워크플로우의 실제 비용은 이전 세대의 Claude 모델들보다 분명히 높습니다.
게다가 그 민감도도 높아졌습니다: 가드레일의 설계가 전반적으로 보수적으로 바뀌어서, 안전을 우선시하여 실수로도 다치게 하는 것을 선호합니다.
비용이 너무 높다는 문제에 대해, 저는 아래와 같은 네티즌들의 실제 테스트 결과를 모았습니다. 이 방법을 사용하면 모두가 비용을 절약할 수 있으면서도 좋은 결과를 얻을 수 있습니다. 모델을 혼합하여 사용하는 방안입니다:
Cursor와 같이 혼합 모델을 지원하는 IDE에서는 다양한 모델들을 플랫폼상에서 단계적으로 사용할 수 있습니다:
1단계: 코드 검토 및 프로젝트 초기 분석을 통해 프로젝트의 구조를 이해하고 상황을 파악합니다. 사용 가능한 도구로는 GPT-5.5, MiniMax M3, Kimi K2.6 또는 Composer 2.5 중 하나가 있습니다.
두 번째 단계: 프로젝트 계획을 수립하고, GPT-5.5 Very High 또는 Opus 4.8을 사용하여 프로젝트 계획을 준비합니다.
3단계: Fable 5를 사용하여 프로젝트 계획을 분석하고 계획에서 오류가 발생할 수 있는 부분을 찾아냅니다. 계획을 수정해야 하는 경우, GPT-5.5를 사용하십시오. Very High.
네 번째 단계: 프로젝트 계획의 실행 및 사용 MiniMax M3, DeepSeek V4, Max, Composer 2.5 또는 Sonnet 4.6을 사용한 계획의 구현.
다섯 번째 단계: 최종 검토에서는 GPT-5.5 High 코드 검토의 최종 결과를 사용하여 구현이 원래 계획에 부합하는지 확인합니다.
가장 올바른 장소에서 가장 비싼 힘을 사용하는 것이 바로 Fable 5를 올바르게 플레이하는 방법입니다.
Claude Fable 5에서 미친 캐릭터를 죽이는 것이 좋은지 나쁜지는 사람마다 다른 의견이 있을 것입니다.
하지만 그것이 있으면 토큰 소비 속도가 매우 명확해져서, 정말 믿을 수 없을 정도입니다.
이 글은 위챗 공식 계정 “JackCui”에서 발표되었으며, 작성자는 “JackCui”입니다.
도움이 되었나요?