AI 초보자 QnA
질문
OpenAI API 이미지 분석은 low로 설정하면 항상 저렴한가요?
답변
아닙니다. 이미지 입력의 detail을 low로 바꿔도 항상 토큰이 줄지는 않습니다. 공식 가이드는 이미지 크기를 조정하는 방식과 토큰 사용량이 모델마다 다르다고 설명합니다. 이름만 보고 가장 싼 옵션으로 고르지 마세요.
이 글은 Responses API에 이미지를 넣어 분석할 때의 설정을 다룹니다. 새 그림을 만드는 이미지 생성 품질이나 ChatGPT 앱의 사진 첨부 설정과는 다릅니다. 사용할 모델의 지원 값과 실제 응답 사용량을 함께 확인하세요.
짧게 답하면
모델 확인 → detail 지원 표 읽기 → 같은 이미지로 비교 → 답변 품질과 사용량 확인 순서로 선택하세요. 전체 장면을 구분하는 일과 작은 글자를 읽는 일은 필요한 세부 정보가 다릅니다.
low·high
이미지 전처리 수준을 고르는 값입니다. 이름만으로 토큰 수와 비용의 순서를 확정하지 않습니다.
original
지원 모델에서 세밀한 글자나 위치가 중요한 이미지를 다룰 때 검토합니다. 크기 제한은 여전히 적용됩니다.
auto
모델의 기본 이미지 크기 처리 방식을 따릅니다. 설정을 생략해도 이 값이 적용됩니다.
처음 쓰는 사람 기준으로 설명하면
같은 화면 캡처를 보내도 모델이 분석 전에 이미지를 줄이는 방식은 다를 수 있습니다. 공식 Images and vision 문서의 Model sizing behavior 표는 모델별 지원 값과 크기 조정 기준을 나눠 안내합니다. 다른 모델에서 확인한 비용을 그대로 적용하지 마세요.
예를 들어 공식 표는
gpt-5.4
계열에서 low가 high보다 더 많은 토큰을 쓸 수 있다고 명시합니다.
gpt-5.2
와
gpt-4.1-mini
는 low·high·auto의 크기 처리 한도가 같으며 original은 지원하지 않습니다. 최신 모델로 바꿨다고 이전 설정의 의미가 유지되지는 않습니다.
작은 글자나 세밀한 위치가 중요하다면 지원 모델의 original을 검토하세요. 다만 original도 모델의 제한에 따라 이미지를 줄일 수 있습니다. 한국어 글자, 회전된 화면, 복잡한 그래프는 틀릴 수 있으므로 높은 세부 수준을 정확도 보증으로 보지 않습니다.
한 줄 정리: detail은 모든 모델에 공통인 할인 단계가 아니라, 선택한 모델이 이미지를 처리하는 방식을 고르는 설정입니다.
바로 따라 해보기
1단계. 시험 이미지와 비교 기준을 정합니다.
전송해도 되는 작은 이미지 한 장을 준비하세요. 전체 장면 분류인지 작은 글자 읽기인지 목적을 정하고 원본에서 정답을 확인합니다. API 모델 ID와 이미지 크기를 기록하되 키나 고객 정보는 남기지 않습니다.
2단계. 이미지 입력 항목에 detail을 넣습니다.
POST /v1/responses
요청의 user 메시지 content에
type="input_image"
, image_url, detail을 넣습니다. 별도 input_text에는 같은 질문을 적으세요. 먼저 지원되는
detail="low"
로 시험한 뒤 모델·이미지·질문을 유지하고 high와 비교합니다.
3단계. 답변과 usage를 나란히 확인합니다.
응답의
usage.input_tokens
와
usage.output_tokens
를 기록하고 읽어야 할 글자나 사물이 맞는지 대조하세요. input_tokens에는 질문 등 다른 입력도 포함됩니다. 이미지 전용 수치로 해석하지 말고 가격표의 입력·출력 단가와 캐시 사용 여부도 확인합니다.
주의할 점
이미지 크기와 detail은 개인정보 보호 설정이 아닙니다. OpenAI는 API 데이터를 기본적으로 학습에 쓰지 않는 기준과 악용 모니터링 로그·기능별 저장을 따로 설명합니다. low로 보냈다고 민감정보가 가려지거나 저장되지 않는다고 생각하면 안 됩니다.
low가 항상 가장 싸고 auto가 항상 같은 옵션이라고 생각합니다. 모델을 바꿀 때는 지원 표와 기본 동작을 다시 읽으세요.
Responses API 예제에 Chat Completions의 이미지 구조를 그대로 붙입니다. Responses는 input_image 항목에 detail을 두며 API별 요청 구조가 다릅니다.
사용량이 줄었다는 이유만으로 숫자와 작은 글자의 오독을 무시합니다. 비용과 원본 대조 결과를 함께 보고 필요한 품질을 만족하는 설정을 고르세요.
웹사이트와 앱 중 무엇부터 쓰면 좋을까요?
지원 값 비교는 공식 웹 문서
Images and vision의 detail 설명과 모델별 표를 나란히 읽으세요. 이미지 입력용 토큰 계산과 새 이미지를 만드는 생성 비용은 다릅니다. 고정된 할인율 대신 현재 모델의 기준을 확인합니다.
실제 확인은 API 개발 환경
키를 안전하게 불러오는 프로그램에서 같은 시험 자료로 결과를 비교하세요. ChatGPT 모바일 앱에 저화질로 읽어 달라고 쓰는 것으로 API detail이 설정되지는 않습니다. 처음에는 여러 이미지를 한꺼번에 보내지 않습니다.
같이 보면 좋은 질문
확인한 공식 자료
OpenAI 공식 가이드 — Images and vision — detail별 용도, 모델별 크기 처리와 토큰 차이, 작은 글자·한국어 이미지의 한계를 확인했습니다.
OpenAI API 문서 — Create a model response — input_image의 detail·image_url 위치와 응답 usage의 입력·출력 토큰 항목을 확인했습니다.
OpenAI 공식 가이드 — Data controls — API의 기본 학습 사용 기준과 악용 모니터링 로그·기능별 저장의 구분을 확인했습니다.
