텍스트 음성 변환 (HTTP)

음성 클론 - 모델 생성

립싱크 - 작업 생성

사용자 프로필

텍스트 음성 변환 (HTTP) — HTTP v2

음성 ID와 선택적 엔진 설정으로 음성을 합성합니다.

텍스트 음성 변환 (HTTP v2)

음성 ID와 선택적 엔진 설정으로 음성을 합성합니다.

Endpoint

POST /api/open/v2/speech/tts

요청 헤더

Content-Type
stringheader필수
application/json
Authorization
stringheader필수
Bearer <token> (API 키)

요청 파라미터

application/json
voiceId
string필수
음성 클론 - 모델 목록
modelId
string선택선택: engine
음성 클론 - 모델 생성
사용 가능한 옵션:fishaudio-s2profishaudio-s1minimax-2.8-turbominimax-2.8-hdminimax-2.6-turbominimax-2.6-hdqwen3-tts-flash
text
string필수
음성을 텍스트로
format
string선택선택: mp3
다양한 형식
사용 가능한 옵션:mp3wavogg
speed
number선택선택: 1
빠른 생성
volume
number선택선택: 0
사용 가능한 옵션:
stability
number선택
오디오-비주얼 동기화
similarity
number선택
음성 클론 - 모델 생성
pitch
number선택
사용 가능한 옵션:
language
string선택
사용 가능한 옵션:
emotion
string선택
무한한 창작
사용 가능한 옵션:happysadangryfearfuldisgustedsurprisedcalm
token
string // Optional if Authorization: Bearer is set
API 잔여량과 기본 계정 정보를 확인합니다.

응답 데이터

// 응답 데이터 - 200
Content-Type: audio/mpeg (or audio/wav / audio/ogg depending on format)
<다양한 형식>

// 응답 데이터

// 조회 실패
{
  "code": string,
  "message": string,
  "requestId"?: string
}

CURL 예시

curl -X POST https://fishspeech.vercel.app/api/open/v2/speech/tts \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -d '{
    "voiceId": "00a1b221-6137-4b73-ad62-b0cbce134167",
    "modelId": "fishaudio-s2pro",
    "text": "Hello, world.",
    "format": "wav",
    "speed": 1,
    "volume": 0
  }' \
  --output output.wav

온라인 디버그

상태 코드

200: Success
400: Bad Request
401: Unauthorized
403: Forbidden
404: Not Found
429: Too Many Requests
500: Internal Server Error