openai입력: 144,000 cr/100만 토큰, 출력: 2,880,000 cr/100만 토큰
GPT-4o mini TTS
OpenAI gpt-4o-mini 기반 음성 합성(TTS). 텍스트를 자연스러운 다국어 음성으로 변환하며, instructions 파라미터로 말투·톤을 지시할 수 있습니다. 회사 OpenAI 계정 직접 연동.
엔드포인트
POST
/api/v1/audio/speechBase URL: https://billing-ai.doublezero.kr
인증
모든 API 요청에는 Authorization 헤더에 Bearer 토큰으로 API Key를 포함해야 합니다.
Authorization: Bearer YOUR_API_KEY요청 파라미터
| 이름 | 타입 | 필수 | 설명 | 기본값 |
|---|---|---|---|---|
model* | string | * 필수 | 사용할 모델 ID. 이 페이지에서는 "gpt-4o-mini-tts"를 사용합니다. | - |
input* | string | * 필수 | 합성할 텍스트. 최대 2,000자. (별칭 text 도 허용) | - |
voice | string | 선택 | 음색. alloy, ash, ballad, coral, echo, fable, nova, onyx, sage, shimmer, verse, marin, cedar 중에서 선택합니다. alloyashballadcoralechofablenovaonyxsageshimmerversemarincedar | alloy |
instructions | string | 선택 | 말투·톤을 지시합니다. 예: "밝고 차분한 톤으로". | - |
response_format | string | 선택 | 출력 오디오 포맷. mp3는 Content-Type audio/mpeg 로 반환됩니다. mp3opusaacflacwavpcm | mp3 |
speed | number | 선택 | 재생 속도. 0.25~4.0 범위로 지정합니다. | - |
응답 필드
| 이름 | 타입 | 필수 | 설명 | 기본값 |
|---|---|---|---|---|
(body)* | binary | * 필수 | 합성된 오디오 바이너리를 그대로 반환합니다(Content-Type은 response_format 에 따르며, mp3→audio/mpeg, wav→audio/wav). 파일로 저장해 재생하세요. | - |
X-Input-Tokens | number (header) | 선택 | 과금에 사용된 입력(텍스트) 토큰 수. | - |
X-Output-Tokens | number (header) | 선택 | 과금에 사용된 출력(오디오) 토큰 수. | - |
코드 예제
curl -X POST https://billing-ai.doublezero.kr/api/v1/audio/speech \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o-mini-tts",
"input": "안녕하세요, 빌링AI 음성 합성입니다.",
"voice": "alloy",
"response_format": "mp3"
}' \
--output speech.mp3참고 사항
- •응답 본문은 합성된 오디오 바이너리입니다. 파일로 저장해 재생하세요.
- •지원 기능: 음성 합성(TTS), 텍스트-음성 변환, 말투 지시(instructions), 다국어 음성, 음색 선택