-
Notifications
You must be signed in to change notification settings - Fork 0
Vietnamese Conversation Recording
Ghi âm Cuộc trò chuyện ghi lại cuộc thảo luận với nhiều người, chuyển lời nói thành văn bản và gán phần đóng góp cho các người nói được phát hiện. Tính năng này sử dụng các mô hình nhận dạng người nói riêng biệt bên cạnh mô hình chuyển lời nói thành văn bản thông thường.
- Mở Cài đặt → Ghi âm Cuộc trò chuyện.
- Chọn một mô hình nhận dạng người nói.
- Sử dụng Quản lý Mô hình để tải các tệp cần thiết.
- Quay lại tab Ghi âm Cuộc trò chuyện và bật ghi âm.
Các loại mô hình có sẵn có những đặc điểm khác nhau về giấy phép và chất lượng:
- Tiêu chuẩn sử dụng Pyannote Segmentation 3.0 với nhúng CAM++. Nó gọn nhẹ và sử dụng giấy phép MIT/Apache 2.0 cho phép thích hợp cho sử dụng thương mại.
- Chất lượng cao sử dụng Reverb Diarization với nhúng NVIDIA TitaNet-Large cho việc phân tách người nói mạnh mẽ hơn. Giấy phép mô hình của nó chỉ cho phép sử dụng phi thương mại.
Kiểm tra giấy phép mô hình trước khi chọn cho các bản ghi âm chuyên nghiệp hoặc thương mại.
- Tạm dừng theo giây cho một phần mới điều khiển thời điểm tạm dừng bắt đầu một phần hội thoại mới.
- Số người nói dự kiến có thể để ở chế độ Tự động hoặc đặt theo số lượng đã biết khi thích hợp.
- Các phần trực tiếp và đã hoàn thiện hiển thị trạng thái hiện tại của chúng.
- Người nói được phát hiện nhận tên chung như Người nói 1 cho đến khi bạn đổi tên.
- Bạn có thể đổi tên các phần, đổi tên người nói, và gán lại một đoạn cho người nói khác.
Các phím tắt nhập liệu bằng giọng nói và điều khiển bằng giọng nói toàn cầu bị tắt khi ghi âm cuộc trò chuyện đang hoạt động.
Độ nhạy phân tách người nói thay đổi mức độ dễ dàng khi tách các giọng nói tương tự:
- Độ nhạy thấp hơn có xu hướng gộp các giọng nói tương tự.
- Độ nhạy cao hơn phân biệt các giọng nói tương tự mạnh mẽ hơn nhưng có thể tạo ra thêm người nói.
Độ nhạy phát hiện giọng nói kiểm soát ngưỡng âm lượng để coi một đoạn âm thanh được phát hiện là lời nói. Giá trị cao hơn loại bỏ tiếng tách và tiếng ồn nền mạnh hơn; giá trị thấp hơn phát hiện giọng nói nhỏ hơn.
- Sao chép đóng góp cá nhân.
- Xóa một đoạn hoặc toàn bộ mục.
- Mở toàn bộ cuộc trò chuyện và tùy chọn bao gồm dấu thời gian.
- Xóa toàn bộ lịch sử cuộc trò chuyện khi bạn không còn cần.
Bật kiểm tra sự thật để cho phép mô hình Nâng cao trí tuệ nhân tạo (AI) cục bộ đã được cấu hình nhận diện các tuyên bố có thể kiểm tra và so sánh chúng với bằng chứng từ Wikipedia. Các phán quyết có thể là Chính xác, Một phần chính xác, Không chính xác hoặc Không thể xác minh và bao gồm giá trị độ tin cậy cùng các liên kết nguồn.
Ranh giới quyền riêng tư: văn bản cuộc trò chuyện được xử lý bởi thời gian chạy AI đã được cấu hình. Với mô hình tích hợp, điều này vẫn diễn ra cục bộ. Chỉ các thuật ngữ tìm kiếm bách khoa toàn thư ngắn—không phải toàn bộ cuộc trò chuyện—mới được gửi đến Wikipedia. Kiểm tra sự thật đòi hỏi AI Nâng cao phải được cấu hình.
Nhận diện người nói là xác suất. Hãy coi việc phân công người nói và phán quyết kiểm tra sự thật là sự trợ giúp, không phải là ghi chép có thẩm quyền.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động