문서

텍스트 음성 변환

텍스트 음성 변환 API로 텍스트를 생생한 음성으로 변환하세요.

개요

텍스트 음성 변환 API는 입력한 텍스트를 원하는 목소리의 자연스럽고 사람다운 오디오로 변환합니다. 라이브러리의 목소리나 복제한 목소리 중 하나를 고르고, 모델을 선택한 다음 오디오 스트림이나 파일을 요청하세요.

빠른 시작

공식 SDK를 설치한 다음 음성 ID와 모델을 지정해 텍스트를 음성으로 변환하세요. 아래 예시는 다국어 모델로 MP3 오디오를 반환합니다.

import { IntuneVoiceClient } from "@intunelabs/intunelabs-js";

const client = new IntuneVoiceClient({ apiKey: process.env.INTUNELABS_API_KEY });

const audio = await client.textToSpeech.convert("JBFqnCBsd6RMkjVDRZzb", {
  text: "The first move is what sets everything in motion.",
  modelId: "intune_multilingual_v2",
  outputFormat: "mp3_44100_128",
});

API 키는 환경 변수로 전달하세요. 클라이언트 측 코드에 시크릿을 하드코딩하거나 소스 저장소에 커밋하지 마세요.

지원되는 모델

intune_v3가장 표현력이 풍부한 출력으로, 연기와 다중 화자 대화에 적합합니다.
intune_multilingual_v2장문 날레이션에 적합한 안정적이고 일관된 품질을 제공합니다.
intune_flash_v2_5실시간 사용에 적합한 초저지연을 제공합니다.

모범 사례

  • 구두점과 자연스러운 문구를 넣어 말하기 속도와 억양을 조절하세요.
  • 대화형 경험에서는 오디오를 스트리밍해 첫 바이트 도달 시간을 최소화하세요.
  • 반복되는 생성 결과를 캐시해 크레딧을 절약하고 지연 시간을 줄이세요.
  • 프로덕션에 사용할 목소리를 결정하기 전에 실제 콘텐츠로 목소리를 테스트하세요.
이 페이지가 도움이 되었나요?

제작 도구:IntuneVoice