-
Notifications
You must be signed in to change notification settings - Fork 0
Korean Conversation Recording
Dan edited this page Aug 21, 2026
·
1 revision
대화 녹음은 여러 사람과의 토론을 기록하고, 음성을 텍스트로 전사하며, 감지된 화자에게 기여를 할당합니다. 이 기능은 일반 전사 모델 외에 별도의 화자 인식 모델을 사용합니다.
- 설정 → 대화 녹음을 엽니다.
- 화자 인식 모델을 선택합니다.
- 모델 관리를 사용하여 필요한 파일을 다운로드합니다.
- 대화 녹음 탭으로 돌아가서 녹음을 활성화합니다.
사용 가능한 모델 패밀리는 서로 다른 라이선스와 품질 특성을 갖고 있습니다:
- **표준(Standard)**은 CAM++ 임베딩을 사용하는 Pyannote Segmentation 3.0을 사용합니다. 컴팩트하며 상업적 사용에 적합한 관대한 MIT/Apache 2.0 라이선스를 사용합니다.
- **고품질(High quality)**은 NVIDIA TitaNet-Large 임베딩을 사용하는 Reverb Diarization을 사용하여 더 강력한 화자 분리를 제공합니다. 이 모델의 라이선스는 비상업적 사용만 허용합니다.
전문적이거나 상업적인 녹음용으로 모델을 선택하기 전에 라이선스를 확인하세요.
- **새 섹션을 위한 일시정지(초 단위)**는 언제 일시정지가 새로운 대화 섹션을 시작할지 제어합니다.
- 예상 화자는 자동으로 두거나 적절한 경우 알려진 수로 설정할 수 있습니다.
- 실시간 및 최종 섹션은 현재 상태를 표시합니다.
- 감지된 화자는 이름을 변경할 때까지 Speaker 1과 같은 일반적인 이름을 받습니다.
- 섹션 이름을 바꾸거나, 화자 이름을 바꾸거나, 발화를 다른 화자에게 재할당할 수 있습니다.
대화 녹음 중에는 글로벌 받아쓰기 및 음성 명령 단축키가 비활성화됩니다.
화자 분리 민감도는 유사한 음성을 얼마나 쉽게 분리할지를 변경합니다:
- 민감도가 낮으면 유사한 음성이 합쳐지는 경향이 있습니다.
- 민감도가 높으면 유사한 음성을 더 적극적으로 구분하지만, 추가 화자가 생성될 수 있습니다.
음성 감지 민감도는 감지된 블록을 음성으로 처리할 볼륨 임계값을 제어합니다. 값이 높으면 클릭 소리 및 배경 소음을 더 강하게 배제하고, 값이 낮으면 조용한 음성도 감지합니다.
- 개별 발언을 복사합니다.
- 구절이나 전체 섹션을 삭제합니다.
- 전체 대화를 열고 필요하면 타임스탬프를 포함합니다.
- 더 이상 필요하지 않을 때 전체 대화 기록을 삭제합니다.
사실 확인을 활성화하면 구성된 로컬 인공지능(AI) 향상 모델이 확인 가능한 주장들을 식별하고 이를 위키피디아 증거와 비교할 수 있습니다. 판정은 정확함(Accurate), 부분적으로 정확함(Partly accurate), 부정확함(Inaccurate), 또는 확인 불가(Unverifiable)일 수 있으며 신뢰도 값과 출처 링크가 포함됩니다.
개인정보 경계: 대화 텍스트는 구성된 AI 런타임에서 처리됩니다. 내장 모델을 사용할 경우 이는 로컬에 머물러 있습니다. 대화 자체가 아니라 짧은 백과사전 검색어만 위키피디아로 전송됩니다. 사실 확인을 위해서는 AI 향상이 구성되어 있어야 합니다.
화자 인식은 확률적입니다. 화자 할당과 사실 확인 판정을 권고로 간주하고, 공식 기록으로 취급하지 마십시오.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động