Anthropic, 캐시 읽기 75% 낮춘 Claude Fable 5.1 출시

구름과 달이 있는 푸른 하늘 위에 Claude Fable 5.1 and Mythos 5.1 문구가 적힌 Anthropic 공식 이미지
Claude Fable 5.1과 Mythos 5.1 공식 출시 이미지다. 이미지: Anthropic

미국 인공지능 기업 앤트로픽(Anthropic)이 9월 2일 Claude Fable 5.1을 출시했다. 일반 고객이 Claude API와 주요 클라우드 플랫폼에서 사용할 수 있는 모델로, 캐시 읽기 가격과 코딩 및 과학 연구 성능, 안전 필터를 함께 손봤다.

캐시 읽기 75% 인하, 기본 가격은 유지

Fable 5.1의 API 입력과 출력 가격은 Fable 5와 같은 100만 토큰당 10달러와 50달러다. 달라진 부분은 에이전트가 이미 처리한 대화와 코드 맥락을 다시 불러오는 캐시 읽기 가격이다. 100만 토큰당 1달러에서 0.25달러로 낮췄다. Anthropic은 8월의 실제 사용량을 기준으로 일반 작업 비용이 약 25%, 캐시 비중이 큰 에이전트 작업은 최대 약 45% 줄어든다고 추산했다. 캐시 읽기 단가가 75% 내려도 입력과 출력 단가는 그대로라 총비용 절감폭은 캐시 비중과 출력량에 따라 달라진다.

모델 ID는 claude-fable-5-1이며 Claude API와 AWS, Google Cloud, Microsoft Azure에서 제공한다.

코딩과 과학 점수 상승, 안전 필터 오탐 60% 감소

Anthropic 평가에서 코딩 에이전트 점수는 Fable 5의 42.0%에서 55.8%로, 과학 연구 과제 점수는 24.7%에서 52.6%로 높아졌다. 회사가 같은 조건에서 비교한 결과다.

사이버 보안 필터는 정상 요청을 잘못 막는 비율을 이전보다 60% 줄였다는 것이 Anthropic의 설명이다. Fable 5.1은 소프트웨어 취약점 발견을 지원하지만, 익스플로잇 개발과 침투 테스트처럼 위험도가 높은 작업은 계속 제한한다. 같은 기반 모델에 더 넓은 사이버 보안과 생명과학 기능을 허용한 Claude Mythos 5.1은 검증된 기관에만 제공한다.

업계는 비용 절감에 주목, 총비용과 거부 문제는 남아

코딩 에이전트 Devin을 개발하는 Cognition은 코딩 작업 토큰의 95% 이상이 캐시 읽기라며 Fable 5.1을 적용한 실제 작업 비용이 10~25% 줄어들 것으로 예상했다. Fable급 모델을 Opus보다 싸게 쓸 수 있게 됐다는 평가다.

독립 모델 평가 기관 Artificial Analysis의 결과는 조건에 따라 비용이 달라진다는 점을 보여준다. Fable 5.1은 자체 지능 지수에서 Fable 5보다 4점 높은 66점을 기록했지만, 최대 추론 설정에서는 출력이 늘어 작업당 비용이 20% 높았다.

오탐 감소가 모든 거부를 없애지는 않았다. Latch Bio는 1만552개 생물학 과제 실행에서 Fable 5.1이 답을 완료했을 때 Opus 5보다 나은 판단을 보였지만, 장시간 과제는 모두 거부됐다고 보고했다. ARC Prize의 Greg Kamradt는 ARC-AGI v3 평가 요청이 안전 필터에서 역공학으로 잘못 분류돼 출시 전 시험을 마치지 못했다고 밝혔다.

Fable 5.1의 핵심은 긴 작업에서 반복해 읽는 맥락의 가격을 낮추고 안전 필터를 다듬은 데 있다. 코딩과 연구 에이전트의 선택지는 넓어졌지만 실제 총비용은 출력 길이와 추론 강도에 따라 달라지고, 전문 연구에서는 거부가 여전히 작업을 중단시킬 수 있다.

원문 출처