openai입력: 300,000 cr/100만 토큰, 출력: 1,200,000 cr/100만 토큰
GPT-4o mini Transcribe
OpenAI gpt-4o-mini 기반 음성 인식(STT). gpt-4o-transcribe 대비 저지연·저가로 대량 전사에 적합합니다. 다국어 인식을 지원합니다. 회사 OpenAI 계정 직접 연동.
엔드포인트
POST
/api/v1/audio/transcriptionsBase URL: https://billing-ai.doublezero.kr
인증
모든 API 요청에는 Authorization 헤더에 Bearer 토큰으로 API Key를 포함해야 합니다.
Authorization: Bearer YOUR_API_KEY요청 파라미터
| 이름 | 타입 | 필수 | 설명 | 기본값 |
|---|---|---|---|---|
model* | string | * 필수 | 사용할 모델 ID. 이 페이지에서는 "gpt-4o-mini-transcribe"를 사용합니다. | - |
file* | file (multipart) | * 필수 | 전사할 오디오 파일. multipart/form-data 로 업로드합니다(OpenAI SDK 기본 방식). mp3·wav·m4a·webm·ogg·flac 등 최대 25MB. | - |
audio_url | string | 선택 | 파일 업로드 대신 사용하는 대안. 공개 접근 가능한 오디오 URL(http/https)을 JSON 본문으로 전달하면 서버가 직접 다운로드합니다. | - |
audio | string | 선택 | base64 또는 data URI 문자열로 오디오를 JSON 본문에 담아 전달하는 대안. 예: "data:audio/mpeg;base64,...". | - |
응답 필드
| 이름 | 타입 | 필수 | 설명 | 기본값 |
|---|---|---|---|---|
text* | string | * 필수 | 전사된 텍스트. | - |
usage.input_tokens | number | 선택 | 입력(오디오) 토큰 수. usage 제공 시 포함됩니다. | - |
usage.output_tokens | number | 선택 | 출력(텍스트) 토큰 수. usage 제공 시 포함됩니다. | - |
코드 예제
curl -X POST https://billing-ai.doublezero.kr/api/v1/audio/transcriptions \ -H "Authorization: Bearer YOUR_API_KEY" \ -F file=@audio.mp3 \ -F model=gpt-4o-mini-transcribe
참고 사항
- •오디오 입력은 multipart/form-data 파일(file) 업로드가 기본이며, JSON 본문의 audio_url(공개 URL) 또는 audio(base64·data URI)로도 전달할 수 있습니다. 파일은 최대 25MB, mp3·wav·m4a·webm·ogg·flac 등을 지원합니다.
- •지원 기능: 음성 인식(STT), 음성-텍스트 변환, 저지연 전사, 다국어 인식