
앤트로픽(Anthropic)과 오픈AI(OpenAI)가 9월 23일 각각 Claude Opus 5.5와 GPT-6 Sol을 출시했다. 두 회사 모두 전작보다 API 가격을 낮추고 코딩과 업무용 답변을 개선했다. Opus 5.5는 Claude 5.5 제품군의 첫 모델이며, GPT-6 Sol은 상위 모델 GPT-6 Astra의 기술을 더 저렴한 모델로 확장한 제품이다.[1][2]
초기 사용 후기는 개선의 방향을 구체적으로 보여준다. 두 모델을 실제 업무에 적용한 Every 팀은 긴 개발 작업에서 Opus 5.5를, 요점을 앞세우는 글쓰기에서는 GPT-6 Sol을 높게 평가했다. Reddit에는 Opus 5의 장황한 설명과 검증 부족이 나아졌다는 반응과 설계 판단이 여전히 아쉽다는 경험이 함께 올라왔다. 다만 출시 직후인 만큼, 두 모델의 직접 비교는 사전 사용자의 경험을 중심으로 형성되고 있다.[3][4]
코딩, 긴 개발 작업에서 호평받은 Opus 5.5
Dan Shipper 미국 AI 미디어 기업 Every 공동창업자 겸 CEO는 팀의 실제 업무를 두 모델에 맡겨본 결과를 X에 공개했다. GPT-6 Sol은 전작 GPT-5.6 Sol보다 Ruby 코드를 잘 작성했지만, 오래 맡겨두는 자율 개발 작업에서는 Opus 5.5가 더 높은 수준의 결과를 냈다고 평가했다. Codex로 옮겼던 팀원 일부가 Claude를 다시 고려할 정도였다는 설명이다.[3]
개발자 Wes Bos도 출시 전 일주일 동안 Opus 5.5를 사용해 운동기구를 3D로 모델링하고 체육관 구성 도구를 만들었다고 밝혔다. 사진을 바탕으로 여러 기구를 구현하는 시각적 개발 작업이었다. 초기 스쿼트 랙 빌더는 Codex로 만들었고 이후 작업에 Opus를 사용한 사례로, 기존 프로젝트를 확장하는 데 신모델을 활용했다.[5]
전작과의 차이는 코드 자체뿐 아니라 결과를 확인하는 과정에서도 언급됐다. Reddit의 r/ClaudeCode에서 한 사용자는 Opus 5의 장황함과 잘못된 설명이 줄었다고 느꼈으며, Opus 5.5가 주장과 결과를 더 꼼꼼하게 검증한다고 썼다. 이전에 해결하지 못했던 문제를 정리하고, 더 납득할 만한 해결책을 제안했다는 경험이다.[4]
같은 스레드에는 다른 평가도 있었다. 앱에 동일한 기능을 구현하도록 했을 때 Opus 5.5는 의문스러운 아키텍처를 선택했고, 상위 모델 Fable 5.1은 기대대로 작동했다는 사용자다. 이 사용자는 Opus 5.5를 xhigh, Fable 5.1을 high 추론 설정으로 실행했다고 밝혔다. 전작보다 구현과 검증이 나아졌다는 반응이 나오지만, 복잡한 설계를 맡길 때는 여전히 Fable을 선호하는 사용자도 있는 셈이다.[4]
글쓰기, 두 회사가 고친 문체와 사용자가 느낀 차이
두 회사는 이번 출시에서 답변 방식의 변화도 강조했다. 앤트로픽은 Opus 5에서 자주 지적받았던 문체를 개선해 중요한 정보를 앞에 배치하고, 전문 용어와 특이한 표현을 줄였다고 설명했다. 오픈AI 역시 GPT-6 Sol에 Astra의 소통 방식을 적용해 불필요한 세부 설명을 덜고 더 명확하고 짧게 답하도록 했다고 밝혔다.[1][2]
Every의 직접 비교에서는 Sol 쪽에 더 좋은 평가가 나왔다. Shipper는 자신의 실제 업무에서 가져온 문단 작성 과제에서 GPT-6 Sol이 간결하게 쓰고 핵심을 앞에 놓았다고 설명했다. 반면 Opus 5.5는 함께 작업하기에는 편안하지만, 초안에서 요점을 뒤로 미루는 경향이 남았다고 평가했다.[3]
이선 몰릭(Ethan Mollick) 미국 펜실베이니아대 와튼스쿨 교수도 X에서 Opus 5.5를 긍정적으로 평가하면서 문체에는 아쉬움을 남겼다. 초기 테스트에서 상위 모델급으로 느꼈지만, 최근 Claude의 지나치게 조밀한 표현 문제는 완전히 해결되지 않았다는 것이다.[6]
현재 드러난 일반 업무의 차이는 주로 이런 문단 작성과 답변의 가독성에 있다. 코딩 결과를 검증하는 설명이 좋아졌다는 반응과 완성된 글이 여전히 빽빽하다는 평가는 서로 다른 작업에서 나왔다. 회사가 말하는 문체 개선과 사용자가 결과물을 덜 고쳐도 된다고 느끼는 변화 사이에는 차이가 남아 있다.
가격은 내려갔지만, 오래 맡기려면 도구의 동작도 봐야
Shipper가 Codex에서 일상적으로 쓸 모델로 고른 것은 GPT-6 Sol이다. 그는 많은 일상 작업에서 Astra에 가까운 결과를 얻으면서 더 빠르게 사용할 수 있었다고 평가했다. 어려운 개발에서는 Opus를 더 높게 봤지만, 평소의 선택은 Sol이었다.[3]
다만 장시간 작업에서는 불편도 있었다. Codex의 보안 분류기가 이미 승인한 작업을 반복해서 중단하고 재승인을 요구했다는 것이다. Shipper는 이를 Sol 자체의 능력과 구분했지만, 작업을 맡기고 자리를 비우기는 어려워졌다고 설명했다. 모델이 좋은 결과를 내는지와 도구가 사람의 개입 없이 작업을 이어가게 해주는지는 별개의 조건이다.[3]
두 모델 모두 API 단가는 전작보다 낮아졌다. Opus 5.5는 100만 토큰당 입력 4달러, 출력 20달러로 Opus 5의 입력 5달러, 출력 25달러에서 각각 20% 내렸다. GPT-6 Sol은 입력 2달러, 출력 10달러로 GPT-5.6 Sol의 프로모션 단가였던 입력 4달러, 출력 20달러의 절반이다. 이는 토큰 단가이며, 실제 작업 비용은 사용한 토큰과 캐시에 따라 달라진다.[1][2]
Opus 5.5는 Pro, Max, Team 요금제의 Claude 앱과 Claude Code, Cowork에서 기본 모델로 제공된다. 개발자는 Claude Platform과 AWS, 구글 클라우드, 마이크로소프트 Azure에서 이용할 수 있다. GPT-6 Sol은 Plus, Pro, Business, Enterprise, Edu 이용자를 대상으로 ChatGPT Work와 Codex에 순차 제공되며 API에서도 쓸 수 있다. 출시 안내 기준으로 일반 Chat에는 아직 제공되지 않는다.[7][1][2]
이번 출시는 두 회사가 상위 모델의 능력을 더 낮은 비용으로 제공하려는 경쟁이다. 초기 후기에서 Opus 5.5는 긴 개발 작업과 검증 과정의 개선으로, GPT-6 Sol은 간결한 글쓰기와 일상적으로 쓸 모델이라는 평가로 주목받았다. 실제 선택에서는 같은 기능 구현과 문서 작업을 맡겨보고, 결과를 고치는 수고와 중간 개입이 각각 얼마나 줄어드는지 살펴볼 만하다.