업데이트

키치랩스 API를 소개합니다.

키치랩스 API로 사용할 목소리를 찾고, 캐릭터의 첫 대사를 음성으로 생성하는 방법을 소개합니다.

키치랩스
여러 이야기의 장면으로 이어지는 유화 풍 문들

키치랩스 API를 소개합니다. 이제 앱에서 고른 AI 보이스를 게임, 애니메이션 제작 도구, AI 캐릭터챗 같은 서비스 안에서도 사용할 수 있습니다. 캐릭터가 처음 인사하는 장면부터 사용자의 선택에 따라 달라지는 대사까지, 목소리가 필요한 순간에 음성을 생성해보세요.

API는 음성 목록 조회, 텍스트 음성 변환, 스트리밍 형식의 응답을 제공합니다. 목소리의 사용 권한과 요청 한도도 계정에 따라 확인됩니다. 요청 형식 전체는 키치랩스 개발자 문서에서 볼 수 있습니다. 아래는 첫 대사를 음성 파일로 만드는 방법입니다.

목소리를 찾고, 대사를 생성하세요

먼저 GET /v1/voices로 현재 계정에서 사용할 수 있는 목소리를 확인합니다. 캐릭터에 어울리는 목소리의 ID를 고른 뒤, 대사와 함께 POST /v1/text-to-speech/{voice_id}로 보내면 음성이 돌아옵니다.

앱의 API 키 관리 화면에서 키를 발급하고, 다음 요청의 YOUR_API_KEY와 VOICE_ID를 실제 값으로 바꿔보세요. API 키는 서버에서만 사용해야 합니다.

curl -X POST "https://api.kitschlabs.com/v1/text-to-speech/VOICE_ID?output_format=mp3_44100_128" \
  -H "xi-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"드디어 왔구나. 기다리고 있었어.","language_code":"ko"}' \
  --output character-line.mp3

이 요청은 MP3 파일을 저장합니다. 실제 제품에서는 서버가 API를 호출한 뒤, 생성된 오디오를 게임의 대사 재생이나 대화 흐름에 맞게 전달하면 됩니다.

스트리밍 형식으로 음성을 받기

오디오를 스트리밍 형식의 HTTP 응답으로 받고 싶다면 같은 요청 본문을 POST /v1/text-to-speech/{voice_id}/stream으로 보내세요. 기존 대사 생성 요청에서 URL 끝에 /stream을 붙이면 됩니다. 지원하는 출력 형식과 인증 방식도 같습니다.

현재 스트리밍 경로는 음성 전체를 생성한 뒤 청크로 전송합니다. 따라서 일반 요청보다 첫 소리가 더 빨리 도착하거나, 생성 중인 단어를 즉시 재생하는 방식은 아닙니다. 실제 서비스에서는 대사 길이와 네트워크 환경에 따른 지연 시간을 측정해 적합한 경로를 선택하세요. 요청·응답 형식은 개발자 문서에서 확인할 수 있습니다.

장면에 맞는 말하기 방식까지

같은 문장도 캐릭터의 관계와 상황에 따라 다르게 들려야 합니다. 요청의 language_code로 지원되는 발화 언어를 지정하고, instruct에 말하기 방식에 대한 자연어 지시를 넣을 수 있습니다. 예를 들어 평소에는 차분한 캐릭터가 재회의 순간에 들뜬 목소리로 말하도록 장면별 지시를 다듬어볼 수 있습니다.

반복해서 쓰는 대사는 여러 문장으로 들어보세요. 한 줄의 인상뿐 아니라 게임의 연속 대사, 애니메이션의 컷 전환, 캐릭터챗의 긴 대화에서도 같은 인물로 느껴지는지가 중요합니다.

실제 서비스에 연결하기 전에

API 키를 브라우저나 앱 코드에 넣지 말고 서버에 보관하세요. 사용할 수 있는 목소리는 계정의 권한에 따라 달라지며, 요청에는 사용량과 크레딧 한도가 적용됩니다. 상업적 사용 범위도 현재 플랜과 음성별 이용 조건을 확인해야 합니다.

첫 연동은 짧은 대표 대사로 시작해 음질, 응답 시간, 실패했을 때의 화면을 함께 점검하는 것이 좋습니다.

여러분의 캐릭터에게 첫 대사를 건네보세요

키치랩스 API는 목소리를 제품의 한 장면에 연결하는 출발점입니다. 개발자 문서에서 요청 형식과 최신 지원 범위를 확인하고, API 키를 만들어 첫 대사를 생성해보세요.

키치랩스

덕질할 수 있는 AI를 만듭니다.