AI 초보자 QnA
질문
OpenAI API로 만든 음성의 말하기 속도는 어떻게 바꾸나요?
답변
OpenAI Speech API에서 글을 음성 파일로 만들 때 speech 생성 요청의
speed
값을 지정하면 말하기 속도를 바꿀 수 있습니다. 별도 값을 넣지 않으면 기본값은
1.0
입니다. 재생기에서 이미 만든 파일을 빠르게 듣는 설정과는 구분하세요.
같은 대본과 목소리로 짧게 시험한 뒤 실제 생성 파일을 들어 보세요. 다만 기존 TTS 모델은 공식 종료 일정이 공지됐으므로, 새 서비스를 오래 운영할 계획이라면 모델 전환까지 함께 살펴야 합니다.
짧게 답하면
모델·목소리·대본을 고정 →
speed
값 지정 → 음성 파일 저장 → 같은 재생 속도로 들어 비교하면 됩니다. 공식 API 참조의 허용 범위는
0.25
부터
4.0
까지이며 기본값은
1.0
입니다.
생성 속도 설정
speed
는 새 음성을 만들 때 요청에 넣습니다. 기존 파일은 다시 생성하지 않는 한 바뀌지 않습니다.
표현 지시
instructions
는 지원 모델에서 목소리의 말투와 속도감을 지시할 수 있지만 수치 설정과 같은 기능으로 보지 않습니다.
듣기 확인
저장된 파일의 재생기 배속을 일정하게 두고 발음, 쉼, 문장 끝이 잘 들리는지 비교합니다.
처음 쓰는 사람 기준으로 설명하면
OpenAI의 Text to speech 가이드는 글을 음성으로 바꾸는 Speech API를 설명합니다. 요청에 모델, 읽을 글, 목소리를 넣고 파일을 받는 방식입니다. 음성의 빠르기를 숫자로 조절하려면 이 생성 요청의
speed
항목을 봐야 합니다. 파일을 다운로드한 뒤 플레이어에서 1.5배속으로 듣는 것과는 작업 단계가 다릅니다.
Speech API 참조에는
speed
가 선택 항목이고 범위가
0.25
~
4.0
, 기본값이
1.0
이라고 명시돼 있습니다. 작은 숫자로 느리게, 큰 숫자로 빠르게 시험할 수 있지만 숫자만으로 자연스러운 쉼이나 정확한 발음을 보장하지는 않습니다. 모델과 목소리까지 바꾸면 속도 효과만 비교하기 어렵습니다.
말투 지시용
instructions
는 지원 모델에서 쓰며
tts-1
과
tts-1-hd
에는 작동하지 않는다고 API 참조가 안내합니다. 또한 OpenAI는 기존 TTS 모델의 2027년 1월 6일 종료와 대체 모델을 공지했습니다. 오래 쓸 자동화라면 현재 파일 생성 절차와 향후 Realtime 전환 계획을 별개로 점검하세요.
한 줄 정리:
speed
는 Speech API의 새 음성 생성 옵션입니다. 재생기 배속이나 API 응답 대기 시간 설정으로 착각하지 마세요.
바로 따라 해보기
1단계. 짧은 대본과 모델을 정합니다.
공식 Speech API 안내에서 현재 쓸 수 있는 모델과 목소리를 확인하고, 공개해도 되는 한두 문장으로 시험하세요. 예제의 모델 이름만 복사하지 말고 종료 공지도 함께 읽습니다.
2단계. 같은 조건으로 두 번 생성합니다.
같은
model
,
voice
,
input
을 유지한 채 첫 요청은
speed=1.0
, 둘째는
speed=0.8
처럼 설정해 각각 다른 파일명으로 저장하세요. 범위 밖 값을 넣지 않습니다.
3단계. 파일을 같은 재생 조건에서 듣습니다.
플레이어 배속을 기본으로 두고 두 파일의 읽기 속도, 고유명사 발음, 문장 사이 쉼을 들어 봅니다. 게시할 음성이라면 대본과 실제 발화가 맞는지도 확인하세요.
주의할 점
OpenAI의 종료 공지에는
tts-1
,
tts-1-hd
와
gpt-4o-mini-tts
스냅샷의 2027년 1월 6일 종료가 적혀 있습니다. 문서의 이전 예제를 장기 운영의 기본 모델로 정하지 마세요. 권장 대체 모델인
gpt-realtime-2.1-mini
의 사용 경로와 속도 조절 방식은 별도 Realtime 안내로 다시 확인해야 합니다.
재생기에서만 배속을 바꿨는데 생성된 음성 파일 자체도 바뀌었다고 판단합니다. 파일을 다시 열어 기본 속도로 확인하세요.
instructions
가 모든 TTS 모델에서 작동한다고 가정하거나, 숫자 속도를 높이면 생성 대기 시간도 비례해 준다고 단정합니다.다른 사람에게 제공하는 음성인데 AI가 만든 목소리라는 사실을 알리지 않습니다. OpenAI 가이드는 최종 이용자에게 AI 생성 음성임을 분명히 고지하도록 요구합니다.
웹사이트와 앱 중 무엇부터 쓰면 좋을까요?
설정을 배울 때는 공식 웹 문서
Text to speech 가이드에서 기본 생성 흐름을 보고 Create speech 참조에서
speed
범위와 모델 조건을 확인하세요. Deprecations 공지도 같은 날 함께 확인하는 편이 안전합니다.
완성 파일을 확인할 때는 재생 앱
API에서 만든 파일을 내려받아 재생기 기본 배속으로 들어 보세요. 앱의 재생 배속만 만져서는 다음 API 생성 요청의
speed
가 바뀌지 않습니다.
같이 보면 좋은 질문
- TTS란 무엇인가요? 음성 생성 기능의 기본 개념을 먼저 알고 싶을 때 읽어 보세요.
- SSML은 무엇인가요? 말하기 속도와 쉬는 곳을 마크업으로 제어하는 다른 방식이 궁금할 때 참고하세요. Speech API가 SSML을 지원한다는 뜻은 아닙니다.
- ChatGPT·Claude·Gemini 목소리는 어떻게 바꾸나요? API 대신 일반 앱의 음성 설정을 찾고 있다면 확인하세요.
확인한 공식 자료
OpenAI 공식 가이드 — Text to speech — Speech API의 모델·대본·목소리 입력과 AI 생성 음성 고지 기준을 확인했습니다.
OpenAI API 참조 — Create speech — speed의 범위와 기본값, instructions의 모델별 제한을 확인했습니다.
OpenAI 공식 문서 — Deprecations — 기존 TTS 모델의 종료 일정과 권장 대체 모델을 확인했습니다.
