
Mythos와 일하는 느낌은 이렇습니다 — Claude 5 Fable 실전 후기 정리
Claude 5 Fable은 무엇인가
Anthropic이 공개한 첫 Mythos급 AI 모델이 Claude 5 Fable입니다. 다단계 명세서를 입력하면 모델이 자체 에이전트를 띄워 조사·코딩·검증을 분담하며 최대 12시간 동안 작업을 수행합니다. 단일 프롬프트와 한 번의 피드백만으로 학술 논문, 운율시, 플레이 가능한 게임까지 만들어내는 능력이 확인됐습니다. 이전에 사용해 본 공개 모델과 상당한 격차를 보입니다.
작업이 시작되면 사용자의 역할은 지시와 결과 판정으로 축소됩니다. 모델은 의사결정 과정을 노출하지 않는 궁극의 블랙박스로 작동합니다. AI와의 관계가 직접 작업하는 '마법사'에서 결과를 의뢰하고 판정하는 '후원자(patron)'로 전환되는 시점입니다. Fable이 공개되기 전까지는 이런 등급의 모델이 일반 사용자에게 노출된 적이 없었습니다.
Fable이 만들어낸 결과물
여러 실험에서 공개된 다른 모델들을 상당한 차이로 능가했습니다. 단일 프롬프트와 한 번의 피드백으로 AI가 만든 것 중 가장 정교한 학술 사회과학 논문을 생성했습니다. 모든 단어가 알파벳 s로 시작하는, 이발을 소재로 10페이지 분량의 운율시도 제작했습니다. Claude Code 환경에서 "Balatro, but for the game of coin flips" 같은 모호한 프롬프트와 "make it better" 피드백만으로 플레이 가능한 게임들이 만들어졌습니다. 자기 인식이 있는 뱀 게임, 깊은 곳으로 내려가는 게임 등 다양한 변형이 같은 방식으로 탄생했습니다.
특히 인상적인 사례는 등시선 지도(isochrone map) 제작이었습니다. 1881년 런던에서 시작한 지도 형식을 현대 데이터로 재현한 작업입니다. Fable은 2,200건 이상의 항공편, TGV부터 Shinkansen까지의 철도 시간표, 국가별 도로 속도 데이터를 수집했습니다. 여러 시간에 걸친 빌드 세션에서 다수의 Claude Sonnet을 실행해 이동 시간을 조사했고, 그 사이 코딩과 검증을 위한 추가 에이전트도 띄웠습니다. Greenland 같은 원격지는 추정치만 담고 있어 실제 이동 시간을 확보하도록 수정 지시를 내렸고, Fable은 적대적 에이전트 그룹 워크플로를 다시 실행해 보정했습니다. 사용자가 한 일은 야심 찬 지시와 약간의 피드백뿐이었습니다.
가장 야심 찬 프로젝트 — Concord
인간이 만들어내는 지저분한 답변을 적절히 분류하는 연구 과업을 Fable에 맡겼습니다. 기존에는 인간 연구자가 판단을 내리고 다른 답변과 통계적으로 비교해 데이터 신뢰도를 확인했습니다. AI와 인간 판단의 보정(calibration)은 어렵고 비용이 큰 작업이었습니다.
Fable은 먼저 19페이지 설계 문서를 생성한 뒤 9시간 30분 동안 작업했습니다. 결과물은 AI가 Concord라 명명한 소프트웨어입니다. 다중 데이터셋을 입력받아 인간·AI 응답을 보정하고 복잡한 데이터 분석을 수행합니다. 완벽하진 않았지만 전문가 입장에서 일부 오류와 누락을 발견해 수정 지시를 전달했고, Fable은 이를 따라 고쳤습니다. 연구자들이 수년간 필요로 했으나 수익성이 없어 만들어지지 않던 종류의 소프트웨어입니다. 남은 잠재적 버그는 소프트웨어 엔지니어가 해결할 수 있으며, 새로운 소프트웨어 활용 폭증에 대응하려면 코더가 더 많이 필요할 수 있습니다. Concord 코드는 GitHub 저장소에서 사용하거나 수정할 수 있습니다.
한계와 제약
Fable의 강력함은 낯섦과 한계를 동반합니다. 토큰 비용은 Opus 대비 2배 비쌉니다. 프로덕션 비용은 상당히 많은 수준으로 토큰을 빠르게 소진합니다. 다만 저렴한 모델로의 영리한 위임이 실제 비용을 상당히 낮출 가능성도 확인됐습니다. 토큰 사용량 한도가 빠르게 소진되어 Max 5x 구독에서도 40분짜리 코드 리뷰 세션에 주간 한도의 16%를 사용한 사례가 보고됐습니다.
보안 문제의 아주 미세한 기미에도 가드레일이 작동해 성능이 낮은 Claude 4.8 Opus로 전환되는 일이 자주 발생합니다. Mythos 논의는 주로 소프트웨어 보안 영향에 집중되었으나 Fable의 가드레일은 사이버보안 용도 사용을 사실상 차단합니다. 여전히 들쭉날쭉한 프런티어(jagged frontier)가 존재하며 산출물과 진행 보고서에 특유의 Claudism 식 문체가 남아 있습니다. Hacker News 의견에서는 AI가 만든 논문의 첫 문단이 실제 데이터 검증 없이 그럴듯하게 꾸며낸 것이라는 비판도 제기됐습니다. 모델이 데이터를 신뢰하라는 프롬프트만 받았다는 점이 결정적 한계로 지적됩니다.
마법사에서 후원자로 — 인간 역할의 변화
작년엔 이 경험을 '주문을 외우면 무언가 일어나는' 마법사(wizard)에 비유했습니다. Fable에서는 주문이 충분히 강력해져 사용자 스스로가 마법사라기보다 후원자(patron)에 가까워집니다. 원하는 것을 묘사하고 비용을 지불하고 결과를 판정합니다. 실제 작업은 볼 수 없는 곳에서 수백 개의 작은 선택을 통해 진행됩니다.
작업이 과정에서 결과로 이동했습니다. 더 이상 조종(steer)하지 않고 의뢰(commission)합니다. 두 가지 가능성이 있습니다. 인터페이스가 따라잡지 못한 일시적 현상일 수 있고, 모델 동작을 들여다보고 중간에 조종하는 더 나은 방법이 나올 가능성도 있습니다. 반대로 모델이 유능할수록 인간이 의미 있게 할 일이 줄고 블랙박스가 그 능력의 대가일 가능성이 더 큽니다.
조종은 여전히 가능하고 지시를 매우 잘 따릅니다. 지시가 야심 찰수록 결과가 더 좋아집니다. 그러나 조종은 더 이상 직접 수행과 같지 않으며, 모델이 자체 에이전트를 띄워 조사·작성·상호 검증을 끝내 완성본을 돌려주는 형태입니다. 후원자가 한 명의 예술가에게 의뢰하는 것이 아니라, Fable은 작업 현장에 발도 들이지 않은 채 최종 결과만 승인하는 스튜디오 전체에 가깝습니다.
그래서 우리도 따라 할 수 있는가
Mythos급 모델이 우리 손에 들어오기까지는 시간이 걸리겠지만, 지금의 Claude Opus 4.8도 Fable 못지않게 많은 작업을 분담할 수 있습니다. 핵심은 작업의 단위를 키우는 것입니다. 잘 정의된 다단계 명세서를 한 번에 맡기고, 중간 과정은 모델에게 위임하며, 결과만 판정하는 후원자 모드를 의식적으로 연습할 가치가 있습니다. Fable의 사례는 AI와 일하는 방식의 다음 단계를 명확히 보여줍니다.
'AI 뉴스' 카테고리의 다른 글
| 하드웨어 해커톤이 다시 뜨는 이유 — AI 시대, 만질 수 있는 결과물의 가치 (0) | 2026.06.12 |
|---|---|
| AI 에이전트의 기억을 프로젝트 단위로 공유하는 'memorize' — 로컬 우선 오픈소스 공개 (0) | 2026.06.12 |
| DiffusionGemma: 4배 빠른 텍스트 생성 — 구글의 텍스트 확산 모델 첫 공개 (0) | 2026.06.11 |
| coders.kr — 방문자가 비용을 내는 무료 호스팅, 개발자 0원 배포 시대 (0) | 2026.06.11 |
| OpenAI, SEC에 S-1 초안 비공개 제출 — IPO 향한 첫 신호 (1) | 2026.06.11 |