AI Product Insight

ChatGPT 5.6 Sol vs Claude Fable 5
"AI 에이전트가 직접 만든 비교 리뷰 사이트"

한국시간 7월 10일 새벽 2시, OpenAI가 최신 모델 GPT 5.6 Sol·Terra·Luna와 함께 Codex·데스크톱 앱을 하나로 합친 통합 ChatGPT 앱, 에이전트 Work, 웹 배포 기능 Sites를 대대적으로 발표했습니다.
Fable 5 재출시와 Cowork 강화로 줄곧 앞서가던 Anthropic에 작정하고 놓은 맞불 - 같은 프롬프트를 양쪽 AI 에이전트에 던져, 비교 리뷰 사이트를 직접 만들게 했습니다.

ChatGPT 5.6 Sol vs Claude Fable 5 - 빈티지 천문 판화의 태양과 박물지 나비 무리가 마주 보는 대치 구도 키비주얼
ONE-LINE TAKEAWAY AI 경쟁의 무대는 채팅창을 떠났습니다.
이제 싸움터는 데스크톱 - 일이 실제로 벌어지고, 결과물이 실제로 배포되는 곳입니다.

1새벽 2시의 발표 - OpenAI, 데스크톱을 갈아엎다

한국 시간 2026년 7월 10일 새벽 2시, OpenAI가 최신 최상위 모델 라인 ChatGPT 5.6 Sol·Terra·Luna를 발표했습니다. 그런데 이번 발표의 진짜 무게는 모델이 아니라 그 옆에 있었습니다. 이용자들의 핵심 사용 경험이 발생하는 데스크톱 앱을 대대적으로 정리한 것입니다.

기존 Codex 앱은 ChatGPT 앱으로 리브랜딩됐고, 새로 발표된 에이전트 Work(Claude의 Cowork에 해당)가 전면에 배치됐습니다. 이 하나의 앱이 업무(Work)와 개발(Codex)라는 두 축을 메인 메뉴로 제공하며, 기존의 Chat은 하위 메뉴로 들어갔습니다. 기존 ChatGPT 앱은 ChatGPT Classic으로 이름이 바뀌었는데, 자연스럽게 선셋되거나 채팅만 원하는 이용자를 위해 남을 것으로 보입니다. 방향은 분명합니다 - 사실상 데스크톱 OS를 타겟팅한다고 봐도 무방합니다.

  • 2026-01 Anthropic, Claude 데스크톱 앱에 Cowork 출시 채팅봇을 넘어 '일이 끝나는 공간'으로 - 에이전트 데스크톱 카테고리를 연 첫 시도.
  • 2026-06 Anthropic, 프런티어 모델 Fable 5 재출시 에이전트 코딩 벤치마크(SWE-bench Pro) 최고치를 다시 쓴 최상위 모델의 귀환.
  • 2026-06~07 Claude 앱, Home & Code로 재편 + Cowork 대폭 강화 Chat과 Cowork을 통합한 Home 신설, PC·랩탑이 꺼져 있거나 오프라인이어도 작업이 이어지는 클라우드 실행, 모바일·웹 확장, Slack 속의 Claude Tag까지 연달아 공개.
  • 2026-07-10 OpenAI, 통합 ChatGPT 앱 + Work + GPT-5.6 발표 Codex 앱을 ChatGPT 앱으로 리브랜딩, Work 전면 배치, Chat은 하위 메뉴로. 기존 앱은 Classic으로.

주목할 점은 이 방향 자체가 새롭지 않다는 것입니다. Anthropic이 올해 1월 Cowork을 선보인 이후 줄곧 걸어온 길입니다. Anthropic은 최근 프런티어 모델 Fable 5를 다시 선보였고, PC·랩탑이 꺼져 있거나 오프라인 상태여도 클라우드에서 작업이 이어지도록 Cowork을 대폭 강화했으며(ChatGPT Work는 시작부터 이 기능을 탑재하고 나왔습니다), Chat과 Cowork을 통합해 Home & Code 구조로 데스크톱 앱을 재편하고, Slack 안에서 일하는 Claude Tag까지 연달아 내놓으며 항상 선도하는 모습을 보여 왔습니다. 이번 발표는 그런 Anthropic에 OpenAI가 작정하고 놓은 맞불입니다. 약 6개월의 격차를 하루 만에 좁히면서, 이제는 둘 다 동일 선상에서 다시 출발해 경쟁하는 국면이 된 셈입니다.

2모델 성적표 - GPT 5.6 Sol vs Claude Fable 5

이번 대결의 밑바탕에는 모델이 있습니다. OpenAI의 새 라인업은 최상위 Sol, 중간 Terra, 경량 Luna의 3단 구성이고, Anthropic은 재출시한 프런티어 모델 Fable 5를 정점으로 Opus 4.8Sonnet 5가 받치는 구조입니다. 아래 키포인트는 두 AI 에이전트가 각자 만든 비교 리뷰 사이트에 정리한 벤더 공개 벤치마크에서 가져왔습니다.

OpenAI GPT 5.6Anthropic Claude
라인업Sol · Terra · LunaFable 5 · Opus 4.8 · Sonnet 5
에이전트 코딩
(SWE-bench Pro)
Sol 64.6% - 전작 GPT-5.5(59.4%) 대비 +5.2%pFable 5 80.3% 최고치, Opus 4.8 69.2%로 Sol 상회
강점 지표웹 에이전트(BrowseComp) 90.4%, 에이전트 코딩 토큰 효율 54% 개선 주장글쓰기·지식 업무(GDPval-AA)는 Sonnet 5가 선두, 브라우저 에이전트는 Opus 4.8 84%
API 가격
(1M 토큰, 입력/출력)
Sol $5 / $30Fable 5 $10 / $50, Opus 4.8 $5 / $25

요약하면 코딩 벤치마크는 Fable 5의 독주이고, Sol은 세대 향상 폭과 토큰 효율·가격으로 맞서는 그림입니다. 플래그십끼리 비교하면 Sol이 Fable 5의 약 60% 가격이라 '성능당 가격' 셈법은 간단하지 않습니다. 상세 차트와 항목별 채점은 아래 두 결과물 사이트에 훨씬 풍부하게 정리되어 있으니, ChatGPT가 만든 리뷰Claude가 만든 리뷰에서 직접 확인해 보세요.

⚖️ 읽는 법
위 수치는 각 벤더가 자체 공개한 값을 두 AI의 리뷰 사이트에서 재인용한 것으로, 채점 환경이 서로 달라 1~2%p 차이는 사실상 동률로 보는 것이 안전합니다.

3신기능 'Sites' - 채팅으로 웹사이트를 '배포'한다

ChatGPT 앱 대개편과 함께 또 하나 전면에 내세운 것이 Sites라는 신기능입니다. 본질은 기존 아티팩트를 웹페이지로 공개 배포하던 기능의 업그레이드인데, 원하는 웹사이트를 채팅으로 바로 만들어 OpenAI가 호스팅하는 도메인에 즉시 배포합니다.

AI가 만들어내는 이미지와 영상이 이미 전체 이미지·영상의 대부분을 점유해가는 중인데, 이제 웹사이트 역시 그 곡선에 올라타 훨씬 가속될 것으로 보입니다. 실제 결과물을 보면 기존 아티팩트의 '단순 웹페이지' 수준을 뛰어넘어 정말로 '웹사이트'라고 부를 만합니다. 그 대가로 아티팩트 생성보다 훨씬 긴 생성 시간이 필요합니다.

4Sites와 Artifacts - 같은 뿌리, 다른 진화

이 신기능도 사실 최근 Anthropic이 발표한 Cowork의 아티팩트 기능과 어느 정도 맞닿아 있습니다. 다만 지향점이 다릅니다. Claude Cowork의 아티팩트는 개인 및 공동 작업자들끼리 공유해서 보는 라이브 업데이트 애셋에 무게를 둡니다 - 대시보드, 트래커, 팀 현황판처럼 세션이 끝나도 살아서 계속 갱신되는 작업물입니다.

반면 Sites는 같은 아이디어를 공개 웹을 향해 밀어붙였습니다. 이 부분은 OpenAI가 이번 새로운 ChatGPT를 통해 Claude의 최근 접근법을 보다 대중적이고 더 강력한 파급력을 갖는 형태로 진화시켰다고 볼 수 있는 대목입니다.

ChatGPT SitesClaude Cowork Artifacts
지향점공개 웹사이트 - 불특정 다수를 향한 배포라이브 애셋 - 나와 협업자를 위한 공유·갱신
배포처OpenAI 호스팅 도메인에 즉시 배포데스크톱 앱 사이드바·아티팩트 갤러리 (공유 가능)
결과물 성격멀티 페이지 구조까지 갖춘 '웹사이트'요건에 최적화된 자기완결형 '웹페이지/도구'
생성 시간길다 (이번 케이스 약 40분)상대적으로 짧다 (이번 케이스 약 10분)

5실측 비교 - 동일 프롬프트, Sites vs Artifacts

점점 AI가 많은 것들을 생성하고 관리하는 시대로 넘어가고 있으니, 일단 ChatGPT Sites와 Claude Cowork Artifacts의 결과물을 직접 비교해봤습니다. 양쪽 모두에게 동일한 프롬프트를 제공했습니다.

동일 제공 프롬프트
새로 나온 ChatGPT(+codex+sol) 데스크톱 앱과 Claude 데스크톱 앱을 비교 분석 리뷰를 보여주는 웹사이트를 만들어줘. 앱뿐만 아니라 모델 성능 차이에 대해서도 잘 보여주면 좋겠어.

작업 모델은 각각 ChatGPT 5.6 Sol (High)Claude Fable 5 (High). 결과물은 아래 버튼으로 직접 확인할 수 있습니다.

두 결과물 모두 수정 없이 생성된 원본 그대로를 게시했습니다.

6읽는 법 - 4배의 시간, 4배 이상의 품질?

위 비교 조건에서 Sites의 결과물이 Artifacts의 결과물보다 훨씬 '웹사이트답게' 많은 것들을 잘 고려하고 있습니다. 다만 이것을 모델의 성능 차이로 읽으면 곤란합니다. 두 기능의 목표와, 그 목표에 따른 최적화 워크플로우가 다르기 때문입니다. 아티팩트는 애초에 웹사이트를 만드는 것이 목표가 아니므로, 요건을 충족하면서 최적의 웹페이지 형태를 만들어낸 것입니다. 내용의 충실함은 두 결과물을 직접 보고 비교해보시길 권합니다.

⏱️ 생성 시간
본 샘플 케이스에서 Sites는 약 40분, Artifacts는 약 10분 - 4배 차이가 났습니다.

인풋 4배만큼의 아웃풋인지는 보는 관점에 따라 다를 것입니다. 개인적으로는 이 정도 품질 차이라면 뒷단의 아키텍처와 고려 사항이 꽤 다를 것이라, 4배 이상의 품질 차이라고 봅니다. 물론 담긴 내용만으로 비교하면 평가가 달라질 수 있습니다.

7다음 실험 - '아티팩트' 말고 '웹사이트'를 시키면?

그렇다면 같은 조건에서 아티팩트가 아니라 "웹사이트를 만들라"고 지시하면 Claude Fable 5는 어떤 결과물을 내놓을까요? 궁금해서 직접 테스트해봤습니다. 결과는 아래 버튼으로 확인해 보세요.

ANTHROPIC Claude Fable 5 × "웹사이트로 만들어줘" 결과물 example-1과 동일 내용, '웹사이트' 수준으로 새롭게 구성 결과물 보기 →
🧪 실험 노트
example-1을 만든 Cowork 스레드에서 이어서 진행한 결과물입니다. 같은 모델(Fable 5 High)이 '아티팩트'와 '웹사이트'라는 목표 차이만으로 결과물을 얼마나 다르게 설계하는지 직접 비교해 보세요.