AI 초보자 QnA
질문
OpenAI API가 읽어 주는 목소리는 어떻게 고르나요?
답변
글을 새 음성 파일로 만드는 OpenAI Speech API에서는 생성 요청의
voice
에 기본 제공 목소리 이름을 넣습니다. 예를 들어
coral
을 선택할 수 있습니다. ChatGPT 앱의 Voice 설정과는 별개입니다.
같은 대본으로 두 목소리를 만들어 듣고 고르세요. 이 글은 이미 녹음한 사람의 목소리를 바꾸거나 특정 인물을 복제하는 방법이 아닙니다. 현재 모델이 지원하는 이름과 종료 일정도 함께 확인합니다.
짧게 답하면
모델 확인 → 지원 목소리 미리 듣기 → voice만 바꿔 생성 → 실제 파일 비교 순서입니다. 이름의 인상만으로 정하지 말고 쓸 언어의 발음과 문장 끝을 들어 보세요.
voice
새 음성을 말할 기본 목소리를 고릅니다. 읽을 글인 input과 구분합니다.
instructions
지원 모델에서 말투나 감정 등을 지시합니다. 기본 목소리를 고르는 이름과는 다릅니다.
결과 파일
선택한 목소리로 새로 생성된 오디오입니다. 이미 저장한 파일은 설정을 바꿔도 그대로입니다.
처음 쓰는 사람 기준으로 설명하면
공지문을 음성으로 만들 때 같은 글을 밝게 읽는 목소리와 차분하게 들리는 목소리 중 고르고 싶을 수 있습니다. Audio and voice 가이드는 이런 내레이션에 Text to speech를 안내합니다. 마이크 대화나 녹음 전사와 작업 경로가 다릅니다.
Text to speech의 Voice options와 Create speech의
voice
목록에는
alloy
,
coral
,
marin
,
cedar
등이 있습니다. 하지만 목소리 지원은 모델마다 다릅니다.
tts-1
과
tts-1-hd
에서는
marin
이나
cedar
를 목록만 보고 복사해 쓰지 마세요.
공식 가이드는 목소리가 영어에 맞춰 최적화되어 있다고 설명하면서 한국어 입력도 지원 언어에 포함합니다. 한국어 대본을 input에 넣어 음성을 만들되, 고유명사와 숫자의 발음은 직접 들어 확인하세요. 권장 목소리라고 한국어 품질까지 보장되지는 않습니다.
한 줄 정리: 목소리는 생성 요청의 voice에서 고르고, 적합한지는 실제 한국어 오디오로 판단합니다. 기기 볼륨이나 앱의 음성 설정으로 API 요청이 바뀌지는 않습니다.
바로 따라 해보기
1단계. 짧은 대본과 비교 조건을 정합니다.
공개해도 되는 한국어 한두 문장을 준비하세요. 공식 문서에서 현재 쓸 모델과 지원 목소리를 확인합니다. 같은 대본·속도·출력 형식을 쓰고 비교할 목소리 두 개를 고르세요.
2단계. 생성 요청의 voice만 바꿉니다.
공식 Python 예시의
client.audio.speech.with_streaming_response.create
에서
model="gpt-4o-mini-tts"
,
voice="coral"
과 input을 지정합니다. 응답은
response.stream_to_file
로 저장하세요. 다음에는 같은 조건에서
voice="alloy"
로 바꾸고 다른 파일명에 저장합니다.
3단계. 두 파일을 직접 듣고 선택합니다.
같은 재생기·볼륨·배속으로 듣고 문장 누락, 이름과 숫자 발음, 쉼을 대조하세요. 선택한 모델·목소리·대본을 기록합니다. 지원하지 않는 이름이라는 오류가 나면 임의의 사람 이름을 넣지 말고 모델별 목록부터 다시 확인합니다.
주의할 점
기존 TTS 모델에는 종료 공지가 있습니다.
tts-1
,
tts-1-hd
와
gpt-4o-mini-tts
의 공지된 스냅샷은 2027년 1월 6일 종료 예정입니다. 이 글의 현재 Speech API 절차를 장기 운영의 영구 경로로 보지 말고 공식 대체 경로를 따로 검토하세요.
voice에 실제 사람의 이름을 쓰면 그 사람의 목소리가 된다고 생각합니다. 기본 목소리 선택과 동의·별도 절차가 필요한 사용자 지정 음성은 다릅니다.
목소리와 모델, 속도, 대본을 한꺼번에 바꾸고 차이를 목소리 탓으로만 돌립니다. 비교할 때는 나머지 조건을 유지하세요.
다른 사람에게 들려줄 때 AI가 만든 음성이라는 사실을 숨깁니다. 공식 가이드는 최종 이용자에게 AI 생성 음성임을 명확히 고지하도록 요구합니다.
웹사이트와 앱 중 무엇부터 쓰면 좋을까요?
목소리 목록은 공식 웹 문서에서
Text to speech의 Voice options에서 미리 듣기와 모델별 지원을 확인하세요. API 참조의 voice 필드와 종료 공지도 함께 봅니다. 다른 음성 API의 목록을 그대로 가져오지 않습니다.
생성과 비교는 개발 환경·재생 앱에서
API를 호출하는 프로그램에서 목소리를 지정하고 저장 파일을 재생 앱으로 들어 보세요. ChatGPT 모바일 앱 설정을 고치는 작업은 아닙니다. API 키나 민감한 대본은 공개 로그에 남기지 않습니다.
같이 보면 좋은 질문
확인한 공식 자료
OpenAI 공식 가이드 — Text to speech — 목소리 목록과 모델별 지원, 한국어 입력, Python 저장 예시와 AI 음성 고지를 확인했습니다.
OpenAI API 참조 — Create speech — voice의 입력 형태와 기본 목소리 이름, instructions의 별도 역할을 확인했습니다.
OpenAI 공식 가이드 — Audio and voice — 내레이션용 음성 생성과 마이크 대화·파일 전사의 구분을 확인했습니다.
OpenAI 공식 문서 — Deprecations — 기존 TTS 모델·스냅샷의 종료 예정일과 별도 대체 경로를 확인했습니다.
