AI 모델 업데이트
Claude Fable 5.1은 비용을 낮추고, Claude Mythos 5.1은 전문 접근을 제한했습니다
앤트로픽은 같은 모델 가중치에 서로 다른 안전장치를 적용한 두 모델을 공개했습니다. Fable 5.1의 캐시 읽기 비용은 75% 낮아졌습니다.
이 글에서 다룰 내용
두 모델의 차이, 캐시 비용 인하, 기본 요금, 벤치마크, 에이전틱 AI 운영 영향
Claude Fable 5.1과 Claude Mythos 5.1, 무엇이 달라졌을까
앤트로픽이 Claude Fable 5.1과 Claude Mythos 5.1을 공개했습니다. 두 모델은 코딩과 지식 업무는 물론, 여러 단계를 스스로 수행하는 장기 작업과 과학 연구 역량까지 강화한 최신 AI 모델입니다.
두 모델은 같은 모델 가중치를 사용하지만 적용되는 안전장치와 이용 범위가 다릅니다.
Claude Fable 5.1은 일반 제공 모델이며, Claude Mythos 5.1은 사이버 보안과 생명과학 분야의 검증된 기관을 위한 제한적 접근 모델입니다. 발표 시점에는 미국의 일부 검증된 조직에만 제공됩니다.
쉽게 말해 Fable은 강력한 성능을 일반 환경에서 안전하게 사용할 수 있도록 만든 버전입니다. Mythos는 같은 기반 모델의 전문 역량을 특정 연구 및 보안 업무에 활용할 수 있도록 별도의 접근 절차를 둔 버전이라고 이해하면 됩니다.
이 글에서 다룰 내용
Claude Fable 5.1의 주요 변화, Claude Mythos 5.1과의 차이, 캐시 비용 75% 인하의 의미, Claude API 이용 요금, 에이전틱 AI 서비스에 미치는 영향
가장 눈에 띄는 변화는 캐시 비용 75% 인하
이번 발표에서 개발자와 기업이 가장 주목할 부분은 캐시 비용 인하입니다. Claude API에서 이미 처리해 저장한 문맥을 다시 불러오는 캐시 읽기 가격이 기존보다 75% 낮아져, 100만 토큰당 0.25달러로 조정됐습니다.
프롬프트 캐싱은 긴 시스템 지침이나 문서, 코드베이스, 대화 기록처럼 반복해서 전달되는 정보를 매번 처음부터 처리하지 않도록 해주는 기능입니다.
같은 문맥을 여러 요청에서 재사용하는 서비스라면 반복 처리 비용을 줄일 수 있습니다.
특히 코딩 에이전트는 파일을 읽고, 코드를 수정하고, 테스트 결과를 확인하는 동안 동일한 프로젝트 정보를 계속 참조합니다.
리서치 에이전트와 업무 자동화 도구도 비슷한 방식으로 많은 문맥을 반복해서 불러오기 때문에 캐시 읽기 비중이 높습니다.
앤트로픽은 일반적인 사용량 기반 작업에서 Fable 5보다 전체 비용이 약 25% 줄어들 것으로 예상했습니다. 문맥과 도구 호출이 많은 에이전틱 AI 작업에서는 최대 약 45%까지 절감될 수 있다고 설명했습니다.
기본 입력·출력 요금은 그대로 유지
캐시 읽기 가격은 크게 내려갔지만 Claude Fable 5.1의 기본 토큰 요금 자체가 모두 낮아진 것은 아닙니다. 입력은 100만 토큰당 10달러, 출력은 100만 토큰당 50달러로 Fable 5와 동일합니다.
따라서 짧고 서로 독립적인 질문만 처리하는 서비스라면 체감 절감 폭이 크지 않을 수 있습니다. 반대로 긴 문서나 코드, 고정된 지침을 반복 사용하는 서비스는 낮아진 캐시 비용의 혜택을 더 크게 받을 수 있습니다.
비용을 판단할 때는 모델의 표시 가격만 비교하기보다 전체 요청에서 캐시 읽기가 차지하는 비율을 함께 살펴봐야 합니다. 반복 문맥이 많을수록 이번 가격 정책의 효과가 커진다는 점이 핵심입니다.
개발자는 Claude API에서
claude-fable-5-1
모델을 선택해 이용할 수 있습니다. Claude Fable 5.1은 앤트로픽 플랫폼뿐 아니라 Amazon Web Services, Google Cloud, Microsoft Azure에서도 제공됩니다.
성능 향상도 비용 절감만큼 중요하다
Claude Fable 5.1은 단순히 저렴해진 모델이 아닙니다. 앤트로픽은 코딩, 지식 업무, 컴퓨터 사용, 과학 연구와 같은 영역에서 이전 Fable 5보다 높은 성능을 보였다고 밝혔습니다.
앤트로픽이 공개한 평가에서 Fable 5.1은 에이전틱 과학 연구 벤치마크인 Terminal-Bench-Science 0.1에서 52.6%를 기록했습니다.
이전 Fable 5의 24.7%보다 높은 결과지만, 실제 업무 성능을 그대로 보장하는 수치는 아닙니다.
에이전틱 코딩 평가인 Terminal-Bench 4.0에서는 Fable 5.1이 55.8%를 기록했고, 제한적으로 제공되는 Mythos 5.1은 60.9%를 기록했습니다.
이 역시 앤트로픽 발표 기준이며, 복잡한 작업 수행 능력을 비교하는 참고 자료로 봐야 합니다.
또한 낮음 또는 중간 수준의 노력 설정에서도 이전 모델과 비슷하거나 더 나은 결과를 더 적은 비용으로 낼 수 있도록 설계됐습니다. 모든 요청에 최고 수준의 추론 자원을 투입하지 않아도 된다는 점은 대규모 서비스를 운영하는 기업에 실용적인 변화입니다.
에이전틱 AI 서비스에 미칠 영향
에이전틱 AI는 한 번 답변하고 끝나는 챗봇과 다릅니다. 목표를 이해한 뒤 자료를 찾고, 도구를 호출하고, 결과를 검토하며, 필요하면 앞선 단계로 돌아가 작업을 이어갑니다.
이 과정에서는 대화 기록과 작업 상태, 시스템 규칙을 계속 참조해야 합니다. 캐시를 효율적으로 활용하면 매 단계에서 동일한 정보를 비싼 기본 입력 토큰으로 다시 처리하는 일을 줄일 수 있습니다.
예를 들어 대규모 코드 저장소를 분석하는 개발 도구, 사내 문서를 바탕으로 보고서를 작성하는 업무 에이전트, 여러 출처를 교차 검증하는 리서치 서비스를 검토할 수 있습니다.
요청 횟수가 많고 작업 시간이 길수록 누적 비용 차이는 더 커질 수 있습니다.
다만 모델만 교체한다고 자동으로 최대 절감률이 적용되는 것은 아닙니다. 캐시 가능한 고정 지침을 앞부분에 배치하고, 자주 바뀌는 사용자 입력을 뒤에 구성하는 등 프롬프트 구조도 함께 점검해야 합니다.
결론: 성능보다 운영비가 더 반가울 수 있다
Claude Fable 5.1과 Claude Mythos 5.1은 앤트로픽의 AI 모델이 단순 응답 도구에서 장기 작업을 수행하는 에이전트로 이동하고 있음을 보여줍니다. 향상된 코딩과 연구 역량도 중요하지만, 실제 서비스를 운영하는 입장에서는 캐시 읽기 가격 75% 인하가 더 직접적인 변화로 다가옵니다.
Claude API를 이미 사용하고 있다면 전체 토큰 사용량만 보지 말고 캐시 생성과 읽기 비율을 확인해 보는 것이 좋습니다. 반복 문맥이 많은 워크로드라면 모델 전환과 프롬프트 구조 개선을 통해 성능 향상과 비용 절감을 동시에 기대할 수 있습니다.
한 줄 요약: Claude Fable 5.1은 향상된 에이전틱 AI 성능에 캐시 비용 75% 인하를 더해, 반복 문맥이 많은 Claude API 서비스의 운영비 절감 가능성을 높인 모델입니다.
