JBFqnCBsd6RMkjVDRZzb와 같은 ID를 대시보드에서 선택하거나 API 요청에 전달합니다. IntuneVoice는 10,000개 이상의 목소리 라이브러리를 제공합니다. 오디오 녹음으로 목소리를 복제하거나 텍스트 설명으로 목소리를 생성할 수도 있습니다.문서
IntuneVoice 문서
IntuneVoice 연동을 위한 문서와 가이드를 살펴보세요
IntuneVoice 작동 방식
IntuneVoice는 텍스트 음성 변환, 음성 텍스트 변환, 음성 복제, 대화형 에이전트, 생성형 오디오를 제공하는 AI 음성 인프라입니다. 사용자 유형에 따라 네 가지 방법으로 사용할 수 있습니다.
IntuneCreative은 크리에이터, 프로듀서, 편집자가 브라우저에서 바로 보이스오버, 음악, 더빙, 스튜디오 프로젝트를 제작할 수 있는 노코드 웹 애플리케이션입니다.
IntuneAgents은 대화형 음성 에이전트를 설계하고 운영하는 플랫폼으로, 비전문가를 위한 비주얼 빌더와 개발자를 위한 완전한 프로그래밍 제어 기능을 모두 제공합니다.
IntuneAPI는 모든 기능을 REST 인터페이스와 공식 Python, TypeScript SDK로 제공하여, 개발자가 자체 애플리케이션과 워크플로에 음성을 연동할 수 있습니다.
IntuneVoice Reception는 중소기업을 위한 바로 배포할 수 있는 AI 전화 응대 서비스로, 하나의 대시보드에서 전화 응답, 약속 예약, 일상 업무 관리를 처리합니다.
개념
intune_v3는 70개 이상의 언어에서 가장 표현력이 풍부한 출력을 생성합니다. intune_flash_v2_5은 약 75ms의 지연 시간으로 실시간 사용을 목표로 합니다. 음성 텍스트 변환, 음악, 음향 효과 등 각 기능에는 전용 모델이 따로 있습니다.나에게 맞는 경로를 선택하세요
모델을 만나보세요
Intune v3
가장 감정이 풍부하고 표현력이 뛰어난 음성 합성 모델
- 극적인 표현과 연기
- 70개 이상의 언어 지원
- 5,000자 제한
- 자연스러운 다중 화자 대화 지원
Intune Multilingual v2
사람처럼 자연스럽고 일관된 품질의 음성 합성 모델
- 자연스러운 출력
- 29개 언어 지원
- 10,000자 제한
- 장문 생성에 가장 안정적
Intune Flash v2.5
빠르고 저렴한 음성 합성 모델
- 초저지연(~75ms†)
- 32개 언어 지원
- 40,000자 제한
- 더 빠른 모델, API 생성 시 문자당 50% 저렴
Scribe v2
최첨단 음성 인식 모델
- 90개 이상의 언어로 정확한 전사
- 핵심 용어 프롬프팅, 최대 1,000개
- 개체 감지, 최대 56개
- 정확한 단어 수준 타임스탬프
- 화자 분리, 최대 32명
- 동적 오디오 태깅
- 스마트 언어 감지
Scribe v2 Realtime
실시간 음성 인식 모델
- 90개 이상의 언어로 정확한 전사
- 실시간 전사
- 낮은 지연 시간(~150ms†)
- 정확한 단어 수준 타임스탬프
† 애플리케이션 및 네트워크 지연 시간 제외
기능별로 찾아보기
이 페이지가 도움이 되었나요?
제작 도구:IntuneVoice