Skip to main content
ElevenLabs Speech to Text 노드는 ElevenLabs API를 사용하여 오디오를 텍스트로 전사합니다. 자동 언어 감지, 화자 분리(다른 화자 식별), 오디오 이벤트 태깅(대본에서 웃음이나 음악과 같은 소리 주석 달기)을 지원합니다.

입력

공통 입력

Scribe v2 입력

이 매개변수는 "scribe_v2" 모델을 선택할 때 표시됩니다. 참고: diarize가 활성화된 경우 num_speakers를 0보다 큰 값으로 설정할 수 없습니다. diarize를 비활성화하거나 num_speakers를 0으로 설정해야 합니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): 7eb5d72615aa8a9e4a8014e45b39cf83dc8d8432d7ce0dccba20489be80a5830