문서
텍스트 음성 변환
텍스트 음성 변환 API로 텍스트를 생생한 음성으로 변환하세요.
개요
텍스트 음성 변환 API는 입력한 텍스트를 원하는 목소리의 자연스럽고 사람다운 오디오로 변환합니다. 라이브러리의 목소리나 복제한 목소리 중 하나를 고르고, 모델을 선택한 다음 오디오 스트림이나 파일을 요청하세요.
빠른 시작
공식 SDK를 설치한 다음 음성 ID와 모델을 지정해 텍스트를 음성으로 변환하세요. 아래 예시는 다국어 모델로 MP3 오디오를 반환합니다.
import { IntuneVoiceClient } from "@intunelabs/intunelabs-js";
const client = new IntuneVoiceClient({ apiKey: process.env.INTUNELABS_API_KEY });
const audio = await client.textToSpeech.convert("JBFqnCBsd6RMkjVDRZzb", {
text: "The first move is what sets everything in motion.",
modelId: "intune_multilingual_v2",
outputFormat: "mp3_44100_128",
});API 키는 환경 변수로 전달하세요. 클라이언트 측 코드에 시크릿을 하드코딩하거나 소스 저장소에 커밋하지 마세요.
지원되는 모델
intune_v3가장 표현력이 풍부한 출력으로, 연기와 다중 화자 대화에 적합합니다.intune_multilingual_v2장문 날레이션에 적합한 안정적이고 일관된 품질을 제공합니다.intune_flash_v2_5실시간 사용에 적합한 초저지연을 제공합니다.모범 사례
- 구두점과 자연스러운 문구를 넣어 말하기 속도와 억양을 조절하세요.
- 대화형 경험에서는 오디오를 스트리밍해 첫 바이트 도달 시간을 최소화하세요.
- 반복되는 생성 결과를 캐시해 크레딧을 절약하고 지연 시간을 줄이세요.
- 프로덕션에 사용할 목소리를 결정하기 전에 실제 콘텐츠로 목소리를 테스트하세요.
이 페이지가 도움이 되었나요?
제작 도구:IntuneVoice