GPT-5.5 UPDATE
GPT-5.5를 지금 볼 때는 “최신 모델인가”보다 “어디서 어떤 역할을 하나”를 먼저 확인해야 합니다
OpenAI는 2026년 4월 23일 GPT-5.5를 공개했고 다음 날 API 제공을 시작했습니다. GPT-5.5는 코딩, 컴퓨터 사용, 지식 업무에서 강한 성능과 에이전트형 도구 사용을 보여준 모델입니다. 다만 2026년 7월 14일 현재 챗GPT의 빠른 기본 응답은 GPT-5.5 Instant가 맡고, 일부 유료 요금제의 깊은 추론과 API의 최신 권장 모델은 GPT-5.6 계열로 이동했습니다.
핵심 1 · 공식 성능
Terminal-Bench 2.0 82.7%, GDPval 84.9%, OSWorld-Verified 78.7%를 기록했습니다.
핵심 2 · API 가격
27만2천 입력 토큰 미만 기준 100만 토큰당 입력 5달러, 캐시 입력 0.50달러, 출력 30달러입니다.
핵심 3 · 현재 위치
GPT-5.5 Instant는 챗GPT의 빠른 기본 모델이고, GPT-5.6은 깊은 추론과 신규 API 개발의 기준이 됐습니다.
이 글에서 다룰 내용
GPT-5.5의 공식 출시 내용, 성능 지표, API 가격과 긴 맥락 할증, 에이전트 도구, 현재 GPT-5.6과의 관계, 마케터와 기획자가 확인할 도입 기준을 정리합니다.
GPT-5.5는 무엇을 바꾼 모델인가
OpenAI는 GPT-5.5를 2026년 4월 23일 공개했습니다. 발표의 중심은 단순한 질의응답 성능이 아니라, 복잡한 업무의 의도를 파악하고 계획을 세우며 여러 도구를 사용해 결과를 끝까지 만드는 능력이었습니다. 코드를 작성하고 디버깅하는 일뿐 아니라 온라인 조사, 데이터 분석, 문서와 스프레드시트 제작, 소프트웨어 조작까지 하나의 작업 흐름으로 연결하는 방향입니다.
GPT-5.5와 GPT-5.5 Pro는 4월 24일부터 API에서도 제공됐습니다. 일반 GPT-5.5는 Responses API, Chat Completions API, Batch API를 지원하고, GPT-5.5 Pro는 Responses API와 Batch API를 지원합니다. Pro는 더 어려운 문제에 더 많은 연산을 쓰는 모델이므로 응답 시간이 길어질 수 있습니다.
출시 당시 GPT-5.5가 중요한 이유는 “답을 더 잘하는 모델”에서 “도구를 사용해 작업을 수행하는 모델”로 무게중심이 이동했기 때문입니다. 모델 성능, 도구 연결, 실행 환경, 사람의 승인과 검토가 함께 설계돼야 실제 에이전트 업무가 완성됩니다.
핵심 인사이트: GPT-5.5의 변화는 모델 단독 점수보다 긴 작업에서 맥락을 유지하고 도구를 조율하며 결과를 검증하는 능력에서 더 잘 드러납니다.
GPT-5.5 성능 수치는 무엇을 의미하나
OpenAI 공식 발표에서 GPT-5.5는 GPT-5.4보다 코딩, 지식 업무, 컴퓨터 사용 평가에서 높은 점수를 기록했습니다.
Terminal-Bench 2.0
GPT-5.5 82.7% · GPT-5.4 75.1%
SWE-Bench Pro
GPT-5.5 58.6% · GPT-5.4 57.7%
GDPval · 승리 또는 동률
GPT-5.5 84.9% · GPT-5.4 83.0%
OSWorld-Verified
GPT-5.5 78.7% · GPT-5.4 75.0%
Terminal-Bench 2.0은 명령줄 환경에서 계획, 반복, 도구 조율이 필요한 복잡한 코딩 작업을 평가합니다. GDPval은 44개 직업의 지식 업무 결과물을, OSWorld-Verified는 실제 컴퓨터 환경을 조작해 과제를 완료하는 능력을 봅니다. 세 지표가 함께 개선됐다는 것은 GPT-5.5의 강점이 코딩 한 분야에만 머물지 않았다는 뜻입니다.
다만 벤치마크 점수가 모든 한국어 업무의 성공률을 보장하지는 않습니다. 사내 문서 구조, 연결한 도구, 프롬프트, 권한, 검수 기준에 따라 결과가 달라집니다. 도입 전에는 실제 업무 자료로 정확도, 재시도 횟수, 처리 시간, 토큰 비용을 함께 측정해야 합니다.
주의: 공식 발표는 같은 Codex 작업에서 GPT-5.5가 GPT-5.4보다 적은 토큰을 사용했다고 설명하지만, 모든 업무에서 40% 절감된다는 고정 수치를 제시하지는 않습니다. 실제 비용을 일률적으로 20%만 증가한다고 계산해서도 안 됩니다.
GPT-5.5 API 가격은 얼마인가
2026년 7월 14일 OpenAI 공식 가격표의 표준 처리 기준입니다. 금액은 모두 100만 토큰당 미국 달러이며 챗GPT 월 구독료가 아니라 API 사용료입니다.
GPT-5.5의 표준 단가는 27만2천 입력 토큰 미만일 때 적용됩니다. 입력이 27만2천 토큰을 넘으면 해당 세션 전체에 입력 2배, 출력 1.5배 단가가 적용됩니다. GPT-5.5는 최대 105만 토큰의 맥락과 12만8천 토큰의 최대 출력을 지원하지만, 긴 맥락을 모두 사용하는 작업은 단가와 처리 시간을 별도로 계산해야 합니다.
표준 가격만 비교하면 GPT-5.5의 입력과 출력 단가는 GPT-5.4의 두 배입니다. 그러나 최종 비용은 실제 입력·출력 토큰, 캐시 적중, 도구 호출, 재시도 횟수에 따라 달라집니다. 모델이 더 적은 시도로 일을 끝내더라도 작업별 측정 없이 비용 절감을 단정하면 안 됩니다.
챗GPT에서 사용하는 비용은 API 가격표가 아니라 Free, Go, Plus, Pro, Business 같은 요금제와 사용 한도를 따릅니다. 구독별 차이는 챗GPT 요금제 비교 글에서 따로 확인할 수 있습니다.
비용 판단 기준: 모델 단가만 보지 말고 성공한 작업 한 건당 총비용을 계산해야 합니다. 토큰, 도구 호출, 재시도, 사람이 수정한 시간을 함께 기록하는 편이 정확합니다.
105만 토큰 맥락은 어떻게 봐야 하나
GPT-5.5 API 모델의 공식 맥락 창은 105만 토큰이고 최대 출력은 12만8천 토큰입니다. 입력은 텍스트와 이미지를 지원하며, 학습 지식 기준일은 2025년 12월 1일입니다.
큰 맥락 창은 여러 문서, 긴 코드베이스, 방대한 조사 자료를 한 요청에 넣을 수 있다는 뜻입니다. 하지만 자료를 많이 넣는 것과 필요한 근거를 정확히 찾는 것은 다른 문제입니다. 오래된 자료, 중복 문서, 서로 충돌하는 지침을 함께 넣으면 오히려 품질이 흔들릴 수 있습니다.
실무에서는 모든 자료를 한 번에 넣기보다 작업에 필요한 범위를 고르고, 출처와 우선순위를 표시하고, 긴 입력 할증 구간을 넘는지 확인해야 합니다. 105만 토큰은 항상 채워야 하는 목표가 아니라 필요할 때 사용할 수 있는 상한입니다.
GPT-5.5의 에이전트 기능은 무엇인가
GPT-5.5 API는 함수 호출, 웹 검색, 파일 검색, 도구 검색, 이미지 생성, 코드 실행, 호스팅 셸, 패치 적용, Skills, 컴퓨터 사용, MCP 같은 도구를 지원합니다. 이 조합을 이용하면 모델이 자료를 찾고, 코드를 실행하고, 파일을 수정하고, 외부 시스템과 연결된 작업을 여러 단계로 이어갈 수 있습니다.
중요한 점은 모델이 도구 이름만 안다고 에이전트가 완성되는 것이 아니라는 사실입니다. 개발자는 사용할 도구, 접근 가능한 데이터, 실행 권한, 중단 조건, 사람의 승인 지점을 정해야 합니다. 챗GPT, Codex, API는 같은 GPT-5.5 계열을 사용하더라도 제공하는 도구와 사용 방식이 서로 다를 수 있습니다.
GPT-5.5 Pro도 모든 도구와 API 방식을 똑같이 지원하는 것은 아닙니다. 공식 모델 문서상 GPT-5.5 Pro는 Responses API와 Batch API에서 제공되고, 일반 GPT-5.5보다 지원 도구 범위가 좁습니다. 제품을 설계할 때는 모델명보다 사용할 엔드포인트와 도구 지원표를 먼저 확인해야 합니다.
에이전트 설계 한 줄: 모델은 판단을 맡고, 도구는 행동을 맡으며, 권한과 승인 절차는 행동의 경계를 정합니다.
지금도 GPT-5.5가 최신 모델인가
2026년 7월 14일 기준으로는 제품에 따라 답이 다릅니다. GPT-5.5 Instant는 로그인한 사용자의 빠른 일상 답변을 담당하는 챗GPT 기본 모델로 남아 있습니다. 반면 지원되는 유료 요금제에서 Medium, High, Extra High 추론은 GPT-5.6 Sol이 맡고, Pro도 GPT-5.6 Sol Pro로 이동했습니다.
OpenAI API의 최신 모델 안내도 신규 복잡 업무의 출발점으로 GPT-5.6을 제시합니다. GPT-5.5 API가 종료됐다는 뜻은 아닙니다. 기존 서비스에서 GPT-5.5를 사용하고 있다면 바로 바꾸기보다 같은 실제 업무로 품질, 토큰, 지연 시간, 비용을 비교한 뒤 이전하는 편이 안전합니다.
챗GPT 빠른 기본 응답
GPT-5.5 Instant
챗GPT 유료 요금제의 깊은 추론
GPT-5.6 Sol · 범위는 요금제와 순차 배포에 따라 다름
신규 API 개발
GPT-5.6 계열을 먼저 검토
기존 GPT-5.5 API 서비스
실제 평가 결과를 기준으로 유지 또는 이전 결정
현재 기준: “GPT-5.5가 사라졌는가”가 아니라 “빠른 기본 응답, 깊은 추론, API 개발 중 어느 제품 화면을 말하는가”를 구분해야 정확합니다.
마케터와 기획자는 무엇을 봐야 하나
첫째, 모델 선택을 업무 단계와 연결해야 합니다. 빠른 초안과 일상 질문, 복잡한 분석, 장시간 도구 작업은 필요한 추론 수준과 비용이 다릅니다. 모든 작업을 가장 비싼 모델 하나에 맡기는 방식은 효율적이지 않을 수 있습니다.
둘째, 에이전트 업무의 승인 지점을 먼저 정해야 합니다. 자료 조사와 초안 작성은 자동으로 진행하더라도 외부 발송, 공개 게시, 데이터 삭제, 결제 같은 행동은 사람이 확인하도록 구분해야 합니다.
셋째, 벤치마크보다 자체 평가표가 중요합니다. 캠페인 보고서라면 출처 정확도, 숫자 오류, 수정 시간, 형식 준수율을 보고, 코딩 업무라면 테스트 통과율과 재작업 횟수를 측정해야 합니다.
넷째, 챗GPT 기능과 API 기능을 섞어 설명하지 않아야 합니다. 챗GPT 구독 요금제, API 토큰 가격, Codex 도구, 커스텀 GPT는 서로 다른 제품 층입니다. 도입 문서에는 실제로 사용하는 제품과 요금제를 명시하는 편이 좋습니다.
기획 관점 한 줄: GPT-5.5가 보여준 변화의 핵심은 모델 경쟁이 답변 품질에서 도구를 연결하고 업무를 끝내는 운영 설계 경쟁으로 넓어졌다는 점입니다.
이번 업데이트에서 바로잡은 내용
- 100만 토큰을 단순 상한으로 쓰지 않고 공식 수치인 105만 토큰과 긴 입력 할증 조건을 반영했습니다.
- “토큰 40% 절감”과 “실비용 약 20% 증가”를 모든 작업에 적용할 수 있는 고정 사실처럼 쓰지 않았습니다.
- 별도 워크스페이스 에이전트와 특정 메일·메신저 연동을 GPT-5.5 모델 자체 기능으로 단정하지 않았습니다.
- 확인할 수 없는 관계자 인용과 비공식 비교 수치를 제거했습니다.
- 출시 당시 제공 범위와 현재 GPT-5.5·GPT-5.6 제품 구성을 분리했습니다.
함께 보면 좋은 글
한 줄 요약
GPT-5.5는 에이전트형 코딩과 지식 업무를 크게 끌어올린 모델이며, 현재는 챗GPT의 빠른 기본 응답을 맡는 동시에 API에서는 GPT-5.6과 비용·성능을 비교해야 하는 선택지입니다.
