메인 콘텐츠로 건너뛰기
POST
/
v1
/
audio
/
transcriptions
curl -X POST "https://api.lemondata.cc/v1/audio/transcriptions" \
  -H "Authorization: Bearer sk-your-api-key" \
  -F file="@audio.mp3" \
  -F model="whisper-1" \
  -F language="en"
{
  "text": "Hello, this is a test of the transcription API."
}

요청 본문

file
file
필수
전사할 오디오 파일입니다. 지원되는 형식: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.
model
string
기본값:"whisper-1"
사용할 모델입니다. 현재 whisper-1만 지원됩니다.
language
string
ISO-639-1 형식의 오디오 언어입니다 (예: en, zh, ja).
prompt
string
모델의 스타일을 가이드하거나 이전 세그먼트를 이어가기 위한 선택적 텍스트입니다.
response_format
string
기본값:"json"
출력 형식: json, text, srt, verbose_json, vtt.
temperature
number
기본값:"0"
샘플링 온도 (0에서 1 사이).
timestamp_granularities
array
타임스탬프 세분화: word 및/또는 segment. verbose_json이 필요합니다.

응답

text
string
전사된 텍스트입니다.
verbose_json의 경우:
task
string
항상 transcribe입니다.
language
string
감지된 언어입니다.
duration
number
초 단위의 오디오 길이입니다.
segments
array
타임스탬프가 포함된 전사 세그먼트입니다.
words
array
단어 단위 타임스탬프 (요청 시).
curl -X POST "https://api.lemondata.cc/v1/audio/transcriptions" \
  -H "Authorization: Bearer sk-your-api-key" \
  -F file="@audio.mp3" \
  -F model="whisper-1" \
  -F language="en"
{
  "text": "Hello, this is a test of the transcription API."
}

번역

오디오를 영어로 번역하려면 번역 엔드포인트를 사용하세요:
response = client.audio.translations.create(
    model="whisper-1",
    file=audio_file
)