AI 모델 업데이트
GPT-6.1 Sol, 코딩 성능과 비용의 균형을 다시 맞췄습니다
OpenAI는 GPT-6.1 Sol을 ChatGPT Work·Codex·API에 제공하며, 일반 Chat에는 아직 제공하지 않는다고 밝혔습니다. 표준 API 단가와 평가 조건을 함께 확인합니다.
이 글에서 다룰 내용
공식 평가 결과의 범위, ChatGPT Work·Codex 제공 대상, 표준 API 단가와 비용 비교
GPT-6.1 Sol, 무엇이 달라졌을까요?
OpenAI가 2026년 9월 29일 GPT-6.1 Sol을 발표했습니다. 기존 GPT-6 Sol보다 복잡한 코딩, 컴퓨터 사용, 전문 업무에 강해진 모델입니다.
가장 눈에 띄는 점은 최상위 모델인 GPT-6 Astra에 가까운 성능을 더 낮은 비용으로 활용하도록 설계했다는 것입니다. 다만 ‘Astra에 가깝다’는 말이 모든 작업에서 결과가 같다는 뜻은 아닙니다. (OpenAI 공식 발표)
이 글에서 다룰 내용
AI 코딩 모델 성능, 컴퓨터 사용 AI 평가 결과, ChatGPT Work와 Codex 제공 범위, API 가격과 사용 전 확인할 점
코딩 성능: 실제 개발 작업에서의 변화
GPT-6.1 Sol은 코드를 한 번에 생성하는 일보다, 기존 코드베이스를 살펴보고 여러 단계를 거쳐 수정하는 작업에서 주목할 만합니다. 복잡한 소프트웨어 개발 과제를 평가하는 DeepSWE v1.1에서 OpenAI는 GPT-6 Astra와 비슷한 성적을 약 5분의 1 비용으로 냈다고 설명합니다.
GPT-6 Sol의 최고 점수보다도 6.4%포인트 높았다는 발표입니다. 단순 코드 완성보다 긴 흐름의 개발 작업에 초점이 맞춰져 있는 셈입니다. (OpenAI 공식 발표)
그렇다면 기존에 쓰던 AI 코딩 모델을 곧바로 바꿔야 할까요? 꼭 그렇지는 않습니다.
같은 저장소와 요청으로 버그 수정, 테스트 작성, 변경 사항 검토를 각각 맡겨 보세요. 성공 여부뿐 아니라 사람이 다시 손본 시간까지 비교해야 팀에 맞는 모델을 고를 수 있습니다.
컴퓨터 사용 AI는 어디까지 좋아졌을까요?
컴퓨터 사용 AI는 화면이나 애플리케이션과 상호작용하며 여러 단계의 일을 처리하는 모델 활용 방식입니다. OpenAI 발표에 따르면 GPT-6.1 Sol은 OSWorld 2.0의 오프라인 평가에서 최대 추론 설정 기준 GPT-6 Sol보다 7%포인트 높은 성적을 냈습니다.
같은 설정의 Astra와는 2.1%포인트 차이였고, 과제당 비용은 약 7분의 1이었다고 합니다. 평가 환경에서의 향상이지, 모든 실제 업무를 오류 없이 자동 처리한다는 보장은 아닙니다. (OpenAI 공식 발표)
예를 들어 문서 확인 뒤 다른 앱에 내용을 입력하는 업무를 시험한다면, 완료 화면만 보지 말고 중간에 잘못 읽거나 입력한 부분이 없는지 확인하는 편이 좋습니다. 특히 외부 전송이나 결제처럼 되돌리기 어려운 행동에는 사람의 승인 단계를 남겨 두세요.
ChatGPT Work·Codex 제공 범위
GPT-6.1 Sol은 일반 Chat 대화용 모델과 구분해야 합니다. OpenAI는 Plus, Pro, Business, Enterprise, Edu 이용자를 대상으로 ChatGPT Work와 Codex에서 제공한다고 밝혔습니다. 개발자는 API에서도 사용할 수 있습니다.
반면 일반 Chat에서는 아직 제공되지 않습니다. ‘ChatGPT에서 쓸 수 있다’는 표현만 보고 평소 대화창에서 모델을 찾으면 혼란스러울 수 있습니다. (OpenAI 공식 발표)
계정에서 모델이 보이지 않는다면 일반 Chat이 아닌 ChatGPT Work 또는 Codex를 살펴보세요. 조직별 접근 설정이 적용되는지는 관리자에게 확인하는 편이 안전합니다. 이번 공식 발표에는 요금제별 단계적 배포 순서가 명시되지 않았으므로, Pro부터 배포된다고 단정할 수 없습니다.
API 가격, 숫자만 보고 비교하면 놓치는 것
GPT-6.1 Sol의 표준 API 가격은 텍스트 100만 토큰당 입력 2달러, 캐시된 입력 0.10달러, 출력 10달러입니다. API에서 지정하는 모델 이름은
gpt-6.1-sol
입니다.
캐시를 반복 활용하는 작업이라면 일반 입력과 캐시 입력을 나눠 비용을 살펴볼 필요가 있습니다. (OpenAI 모델 문서)
기본 단가가 전체 청구액은 아닙니다. 공식 모델 문서에 따르면 입력이 27만 2천 토큰을 넘는 요청에는 다른 단가가 적용되며, Fast 모드와 도구 호출에도 별도 비용 조건이 있습니다.
ChatGPT 구독으로 Codex를 이용하는 방식과 API 키로 직접 호출하는 방식을 동일한 과금 체계로 취급하지 마세요. 도입 전에는 토큰 비용과 도구 비용, 작업 완료율을 함께 비교하는 것이 안전합니다. (OpenAI 모델 문서)
GPT-6.1 Sol은 더 어려운 일을 맡기면서 비용도 관리하고 싶은 개발자와 업무팀에 흥미로운 선택지입니다. 먼저 익숙한 작업 몇 개를 골라 기존 모델과 같은 조건으로 비교해 보세요. 발표된 성능 수치보다 내 작업에서 줄어든 수정 시간과 실제 비용이 선택의 기준이 됩니다.
한 줄 요약: GPT-6.1 Sol은 코딩·컴퓨터 사용 성능을 강화한 모델로, Work·Codex·API에서 사용할 수 있지만 일반 Chat 제공 여부와 실제 작업 비용은 구분해 확인해야 합니다.
