-
Notifications
You must be signed in to change notification settings - Fork 0
Polski Conversation Recording
Nagrywanie rozmów rejestruje dyskusję z wieloma osobami, transkrybuje mowę i przypisuje wkład wykrytym mówcom. Oprócz normalnego modelu transkrypcji ta funkcja wykorzystuje oddzielne modele rozpoznawania mówiącego.
- Otwórz Ustawienia → Nagrywanie rozmowy.
- Wybierz model rozpoznawania mówiącego.
- Użyj Zarządzaj modelami, aby pobrać wymagane pliki.
- Wróć do zakładki Nagrywanie rozmowy i włącz nagrywanie.
Dostępne rodziny modeli charakteryzują się różnymi cechami licencyjnymi i jakościowymi:
- Standard wykorzystuje Pyannote Segmentation 3.0 z osadzeniem CAM++. Jest kompaktowy i wykorzystuje liberalne licencje MIT/Apache 2.0 odpowiednie do użytku komercyjnego.
- Wysoka jakość wykorzystuje diaaryzację pogłosu z osadzeniem NVIDIA TitaNet-Large dla silniejszej separacji głośników. Licencja modelowa pozwala wyłącznie na wykorzystanie niekomercyjne.
Sprawdź licencję modelu przed wybraniem go do nagrań profesjonalnych lub komercyjnych.
- Przerwa w sekundach dla nowej sekcji kontroluje, kiedy pauza rozpoczyna nową sekcję rozmowy.
- Oczekiwane głośniki można pozostawić w trybie automatycznym lub w razie potrzeby ustawić na znaną liczbę.
- Sekcje na żywo i ukończone pokazują ich aktualny stan.
- Wykryte głośniki otrzymują nazwy ogólne, takie jak Głośnik 1, dopóki ich nazwy nie zostaną zmienione.
- Możesz zmieniać nazwy sekcji, nazwy głośników i ponownie przypisywać fragment do innego mówcy.
Globalne dyktowanie i skróty poleceń głosowych są wyłączone, gdy aktywne jest nagrywanie rozmów.
Czułość separacji głośników zmienia stopień łatwości podziału podobnych głosów:
- Niższa czułość ma tendencję do łączenia podobnych głosów.
- Wyższa czułość umożliwia bardziej agresywne rozróżnianie podobnych głosów, ale może spowodować utworzenie dodatkowych głośników.
Czułość wykrywania mowy kontroluje próg głośności w celu traktowania wykrytego bloku jako mowy. Wyższe wartości silniej odrzucają kliknięcia i szumy tła; niższe wartości wykrywają cichszą mowę.
- Skopiuj indywidualny wkład.
- Usuń fragment lub całą sekcję.
- Otwórz całą rozmowę i opcjonalnie dołącz znaczniki czasu.
- Wyczyść całą historię rozmów, gdy już jej nie potrzebujesz.
Włącz sprawdzanie faktów, aby skonfigurowany model ulepszeń lokalnej sztucznej inteligencji (AI) identyfikował możliwe do sprawdzenia twierdzenia i porównywał je z dowodami z Wikipedii. Werdykty mogą być dokładne, częściowo dokładne, niedokładne lub nieweryfikowalne i zawierać wartość zaufania oraz linki do źródeł.
Granica prywatności: tekst rozmowy jest przetwarzany przez skonfigurowane środowisko wykonawcze AI. Dzięki wbudowanemu modelowi pozostaje to lokalne. Do Wikipedii wysyłane są tylko krótkie hasła wyszukiwane w encyklopedii, a nie sama rozmowa. Sprawdzanie faktów wymaga skonfigurowania funkcji AI Enhancement.
Rozpoznawanie mówiącego jest probabilistyczne. Traktuj przypisanych mówców i werdykty oparte na weryfikacji faktów jako pomoc, a nie jako wiarygodne zapisy.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động