ElevenLabs 문서
ElevenLabs 문서
ElevenLabs 통합을 위한 문서와 가이드를 살펴보세요
ElevenLabs 작동 방식
ElevenLabs는 텍스트 음성 변환, 음성 텍스트 변환, 음성 복제, 대화형 에이전트, 생성형 오디오를 제공하는 AI 음성 인프라입니다. 대상에 따라 적합한 네 가지 방식으로 사용할 수 있습니다.
ElevenCreative 는 크리에이터, 프로듀서, 편집자가 브라우저에서 바로 보이스오버, 음악, 더빙, 스튜디오 프로젝트를 생성할 수 있는 노코드 웹 애플리케이션입니다.
ElevenAgents 는 대화형 음성 에이전트를 설계하고 운영하는 플랫폼으로, 비기술 사용자를 위한 시각적 빌더와 개발자를 위한 완전한 프로그래밍 방식의 제어 기능을 제공합니다.
ElevenAPI 는 모든 기능을 공식 Python 및 TypeScript SDK가 포함된 REST 인터페이스로 제공하므로, 개발자는 자체 애플리케이션과 workflow에 음성을 통합할 수 있습니다.
Reception AI 는 중소기업을 위한 즉시 배포 가능한 AI 전화 리셉셔니스트로, 하나의 대시보드에서 전화를 받고, 예약을 잡고, 일상적인 운영을 관리합니다.
주요 개념
음성은 오디오 생성에 사용되는 음성 페르소나입니다. 각 음성에는 JBFqnCBsd6RMkjVDRZzb와 같은 고유 ID가 있으며, 대시보드에서 선택하거나 API 요청에 전달할 수 있습니다. ElevenLabs는 10,000개 이상의 음성 라이브러리를 운영합니다. 오디오 녹음으로 음성을 복제하거나 텍스트 설명을 바탕으로 새 음성을 생성할 수도 있습니다.
모델은 생성되는 오디오의 품질, 지연 시간, 지원 언어 범위를 제어합니다. eleven_v4는 90개 이상의 언어에서 가장 풍부한 표현력을 갖춘 결과물을 생성합니다. eleven_v4_turbo는 중앙값 추론 지연 시간이 약 100ms인 실시간 사용을 위해 설계되었습니다. 음성 텍스트 변환, 음악, 음향 효과 등 각 기능에는 전용 모델이 있습니다.
크레딧은 모든 제품에서 공통으로 사용하는 사용량 단위입니다. 텍스트 음성 변환은 입력 텍스트의 문자당 1크레딧이 소모됩니다. 그 외 작업은 처리된 오디오의 초 단위로 과금됩니다. 크레딧은 매월 초기화되며, 사용하지 않은 크레딧은 최대 2개월까지 이월됩니다. 자세한 내용은 요금제를 참조하세요.


