-
Notifications
You must be signed in to change notification settings - Fork 0
Indonesian Settings Reference
Buka Pengaturan dengan tombol roda gigi. OK menyimpan perubahan; Batal membatalkannya. Perubahan yang mempengaruhi model, runtime, lokasi penyimpanan, atau layanan jaringan mungkin memerlukan waktu untuk diterapkan dan dapat memuat ulang suatu komponen.
Referensi ini dimaksudkan sebagai panduan penyetelan, bukan hanya sebagai daftar kontrol. Default merupakan titik awal yang baik untuk sebagian besar instalasi Windows lokal. Ubah satu pengaturan terkait pada satu waktu, uji di aplikasi tempat Anda benar-benar mendikte, dan simpan nilai sebelumnya sampai hasilnya jelas lebih baik.
| Tujuan | Titik awal yang disarankan |
|---|---|
| Dikte sehari-hari yang andal di aplikasi desktop biasa | Bahasa transkripsi tetap, penyisipan Clipboard, pemulihan clipboard diaktifkan, jeda default, normalisasi audio diaktifkan |
| Dikte ke terminal atau desktop jarak jauh | Coba Unicode terlebih dahulu jika penerusan clipboard tidak tersedia. Jika tidak, pertahankan Clipboard dan pilih pintasan tempel yang diterima oleh target jarak jauh. Gunakan Scan Code untuk aplikasi yang hanya merespons dengan andal terhadap input seperti tombol fisik. |
| Dokumen panjang | Bahasa tetap, tanda baca diucapkan, pemformatan berantai, mode hotkey tertahan atau hibrida, rekaman WAV yang disimpan |
| Kolom pencarian singkat, chat, dan perintah | Hapus titik di akhir; opsional gunakan pemformatan huruf pertama kecil; mode hotkey tertahan menghindari perekaman tetap aktif secara tidak sengaja |
| Penggunaan yang tenang atau sensitif terhadap privasi | Nonaktifkan rekaman WAV yang disimpan, tinjau retensi transkripsi, nonaktifkan penyisipan clipboard jika aplikasi pemantau clipboard menjadi kekhawatiran, dan hindari runtime jarak jauh | | Latensi yang terasa paling rendah | Nonaktifkan pratinjau real-time kecuali bila berguna, gunakan model/runtime transkripsi lokal yang cepat, jaga agar penundaan penyisipan tetap rendah, dan jangan kumpulkan keluaran AI sebelum penyisipan |
- Bahasa transkripsi: Pilih bahasa yang paling sering Anda gunakan. Bahasa tetap biasanya mulai lebih cepat dan lebih dapat diandalkan daripada Otomatis, terutama untuk dikte singkat, nama, dan kata-kata yang terdengar mirip. Gunakan deteksi otomatis hanya ketika Anda benar-benar berganti bahasa antara rekaman; deteksi bahasa memiliki bukti yang lebih sedikit dalam frasa pendek dan bisa memilih secara salah.
- Istilah dan nama khusus yang disesuaikan: Tambahkan nama yang tidak umum, istilah produk, singkatan, dan ejaan yang ingin Anda agar Whisper prioritaskan. Pertahankan daftar tetap fokus: ini memandu pengenalan tetapi bukan aturan pencarian-dan-ganti yang dijamin, dan daftar panjang kata biasa dapat memperkenalkan bias yang tidak diinginkan. Panduan ini ditujukan untuk Whisper; mesin transkripsi lain mungkin tidak menggunakannya dengan cara yang sama.
Metode penyisipan terbaik tergantung pada aplikasi target. Ujilah pada program yang paling sulit Anda gunakan, bukan hanya di editor sederhana.
-
Clipboard: Pilihan umum terbaik di Windows dan biasanya paling cepat untuk teks panjang, karakter khusus, dan Unicode yang kompleks. Voice2Win sementara menggantikan clipboard, mengirim perintah tempel, dan dapat mengembalikan konten sebelumnya. Pengelola clipboard atau aplikasi lain dapat melihat teks sementara, dan penerusan clipboard mungkin dinonaktifkan dalam sesi jarak jauh.
-
Unicode: Tidak tergantung tata letak dan merupakan alternatif pertama yang baik untuk sesi jarak jauh, sistem non-Windows, dan teks yang berisi karakter yang tidak ada pada tata letak keyboard saat ini. Beberapa game, terminal, aplikasi lama, dan jendela dengan hak istimewa tinggi tidak menerima Unicode simulasi dengan andal.
-
Kode Pindai: Berperilaku paling mirip dengan input keyboard fisik dan dapat membantu dengan aplikasi target yang lebih lama atau tidak biasa. Ini tergantung pada tata letak keyboard aktif; karakter yang tidak memiliki tombol yang sesuai pada tata letak tersebut mungkin hilang atau salah. Biasanya ini lebih lambat daripada menempelkan clipboard tunggal untuk teks panjang.
-
Penundaan simulasi keyboard (0–50 ms): Biarkan rendah kecuali memasukkan karakter Unicode atau Kode Pindai kehilangan atau mengubah urutan karakter. Tingkatkan secara bertahap untuk aplikasi yang lambat, mesin virtual, atau desktop jarak jauh. Pengaturan ini hanya memperlambat ketukan tombol yang disimulasikan; ini tidak meningkatkan pengenalan suara.
-
Gunakan clipboard untuk aplikasi target yang bermasalah: Biarkan ini diaktifkan saat menggunakan Unicode atau Kode Scan kecuali penggunaan clipboard dilarang. Voice2Win kemudian dapat mengambil alih untuk aplikasi yang dikenal tidak menerima input simulasi dengan baik. Nonaktifkan hanya ketika privasi clipboard atau penerusan clipboard menjadi alasan Anda sengaja memilih simulasi keyboard.
-
Waktu tunggu sebelum penyisipan (0–2000 ms, default 40 ms): Waktu agar nilai clipboard baru tersedia sebelum pintasan tempel dikirim. Tingkatkan ini ketika target kadang-kadang menempelkan nilai clipboard sebelumnya atau tidak menempel sama sekali, terutama melalui sinkronisasi clipboard jarak jauh. Nilai yang lebih besar menambahkan jeda yang sama pada setiap penyisipan.
-
Kombinasi tombol tempel: Gunakan Ctrl+V untuk aplikasi Windows biasa. Coba Ctrl+Shift+V atau Shift+Insert ketika terminal, desktop jarak jauh, atau alat AI memperlakukan Ctrl+V sebagai sesuatu selain tempel teks biasa. Pilih pintasan yang diharapkan oleh target akhir, tidak selalu oleh jendela desktop jarak jauh lokal.
-
Kumpulkan teks selama peningkatan AI dan sisipkan dalam satu langkah: Aktifkan ini saat keluaran AI progresif memindahkan kursor, memicu format atau penyelesaian otomatis, atau membuat beberapa langkah batal. Nonaktifkan ini ketika melihat hasil secepat mungkin lebih penting; pengumpulan menunggu hingga hasil AI selesai sebelum sesuatu disisipkan.
-
Pulihkan clipboard sebelumnya: Biarkan ini aktif untuk pekerjaan normal agar Voice2Win tidak merusak apa yang Anda salin sebelum dikte. Nonaktifkan hanya jika Anda sengaja ingin hasil dikte tetap berada di clipboard atau target tertentu membaca clipboard setelah pintasan tempel sudah dikembalikan.
-
Waktu tunggu sebelum pemulihan (0–2000 ms, default 120 ms): Tingkatkan ini ketika target tidak memasukkan apa pun atau hanya sebagian teks karena nilai clipboard sebelumnya dipulihkan terlalu cepat. Pertahankan hanya setinggi yang diperlukan: selama interval ini teks yang didikte tetap tersedia untuk aplikasi yang sadar clipboard.
Opsi ini mengubah teks yang dikenali sebelum dimasukkan. Mereka paling berguna ketika diktasi Anda mengikuti pola yang konsisten.
-
Tanda baca lisan: Aktifkan untuk prosa yang lebih panjang ketika Anda ingin frasa seperti “koma”, “tanda tanya”, atau padanan khusus bahasa mereka diubah menjadi tanda baca. Nonaktifkan ketika kata-kata tersebut mungkin merupakan konten literal, atau ketika Anda lebih memilih tanda baca otomatis dari model transkripsi.
-
Hapus titik di akhir: Berguna untuk bidang pencarian, pesan obrolan, bidang formulir, nama file, dan perintah suara di mana titik akhir yang ditambahkan secara otomatis tidak diinginkan. Nonaktifkan untuk kalimat lengkap dalam dokumen dan email.
-
Huruf pertama kecil: Berguna ketika dikte biasanya dimasukkan di tengah kalimat yang sudah ada. Nonaktifkan untuk kalimat baru, judul, nama, dan pesan tunggal.
-
Hubungkan dikte berturut-turut di aplikasi yang sama: Aktifkan ini ketika Anda membuat satu paragraf dari beberapa rekaman; Voice2Win dapat menjaga jarak dan konteks kalimat di antara mereka. Nonaktifkan ini ketika rekaman berturut-turut biasanya masuk ke bidang yang berbeda, atau ketika Anda sering memindahkan kursor secara manual antara dikte.
-
Sensitivitas deteksi ucapan (0–100, default 35%): Nilai yang lebih rendah menerima ucapan yang lebih pelan tetapi juga bisa menganggap pernapasan, klik, atau kebisingan latar sebagai ucapan. Nilai yang lebih tinggi menyaring kebisingan lebih agresif tetapi mungkin menolak suara lembut atau akhir kata. Mulailah pada nilai default dan ubah secara bertahap sambil memantau level input; memindahkan mikrofon lebih dekat seringkali lebih baik daripada menggunakan nilai ekstrem.
-
Bersihkan awal rekaman (0–500 ms, default 250 ms): Menekan suara klik hotkey, kebisingan saat menangani, dan keheningan awal di awal rekaman. Tingkatkan jika bagian pertama rekaman mengandung klik tombol; kurangi jika suku kata pertama terpotong atau Anda mendikte kata yang sangat pendek segera setelah menekan hotkey.
-
Normalisasi rekaman (default aktif, target 85%): Disarankan untuk mikrofon biasa dan jarak bicara yang bervariasi karena memberikan level yang lebih konsisten ke model. Nonaktifkan jika input studio/virtual sudah dinormalisasi, atau ketika normalisasi secara signifikan meningkatkan kebisingan latar belakang yang konstan. Target ini bukan kontrol gain mikrofon dan tidak dapat memulihkan audio yang terpotong.
-
Simpan rekaman WAV (default aktif): Biarkan aktif ketika Anda ingin memutar ulang, menyalin ulang transkripsi, membandingkan kualitas, atau bukti diagnostik. Nonaktifkan jika penggunaan penyimpanan atau kerahasiaan lebih penting. Audio biasanya menghabiskan ruang jauh lebih banyak dibanding teks.
-
Hapus rekaman WAV yang tersimpan: Menghapus audio yang tersimpan sambil tetap menyimpan teks transkripsi. Gunakan setelah memastikan Anda tidak lagi membutuhkan pemutaran ulang atau penyalinan transkripsi; penghapusan tidak dapat mengembalikan audio asli.
- Tahan: Perekaman berlangsung hanya selama pintasan ditekan. Paling cocok untuk dikte singkat dan sering serta merupakan mode teraman ketika perekaman latar belakang yang tidak disengaja harus dihindari.
- Kait: Tekan sekali untuk memulai dan sekali lagi untuk menghentikan. Paling cocok untuk bacaan panjang, penggunaan aksesibilitas, atau berbicara tanpa tangan, tetapi memerlukan tindakan berhenti secara sengaja.
- Hibrida / ketuk ganda: Tahan untuk perekaman singkat atau ketuk ganda untuk mengait. Ini adalah default paling fleksibel untuk pekerjaan campuran. Gunakan Tahan jika ketukan ganda yang tidak disengaja kadang-kadang membuat perekaman tetap aktif.
-
Tetapkan pintasan terpisah untuk Speech to Text dan Voice Command. Pilih kombinasi yang belum digunakan oleh sistem operasi, driver keyboard, remote desktop, atau aplikasi target. Pintasan Voice2Win yang duplikat akan ditolak.
-
Di Windows, Voice2Win biasanya tidak dapat menyuntikkan ke dalam aplikasi yang berjalan dengan hak istimewa lebih tinggi. Jalankan Voice2Win dengan hak istimewa hanya saat dikte ke aplikasi dengan hak istimewa tinggi benar-benar diperlukan; akses input global dengan hak istimewa tinggi meningkatkan dampak dari kesalahan aplikasi atau konfigurasi apa pun.
-
Matikan output audio global saat hotkey ditekan berguna dengan speaker karena audio sistem tidak dapat masuk kembali ke mikrofon. Nonaktifkan saat menggunakan headphone atau saat mendengarkan pertemuan atau sumber media selama perekaman diperlukan.
-
Sinyal mulai dan berhenti yang terpisah membuat status latch/hybrid jelas saat indikator tidak terlihat. Jaga suara tetap pendek dan pelan saat menggunakan speaker agar mikrofon tidak menangkapnya. Tingkatkan durasi atau volume untuk aksesibilitas, bukan untuk mengatasi deteksi hotkey yang tidak dapat diandalkan.
- Bahasa antarmuka hanya mengubah menu dan label; ini tidak memilih bahasa transkripsi.
- Tema gelap adalah preferensi visual dan tidak memengaruhi pengenalan atau kinerja.
- Gaya indikator: tampilan level sederhana paling tidak mengganggu; gelombang atau batang memudahkan menilai aktivitas bicara; tampilan bergaya spektrum menunjukkan lebih banyak detail tetapi secara visual lebih ramai. Pilih gaya yang membantu Anda memastikan aktivitas mikrofon tanpa menutupi aplikasi target.
- Skema warna, posisi, dan ukuran: Gunakan skema kontras tinggi dan posisi yang jauh dari bilah alat, keterangan, dan kursor teks. Indikator yang lebih besar membantu aksesibilitas dan teks real-time; yang lebih kecil lebih baik jika hanya status rekaman yang penting.
-
Autostart dinonaktifkan adalah yang terbaik ketika Voice2Win digunakan sesekali. Autostart registry adalah pilihan normal Windows untuk memulai setelah masuk. Task Scheduler berguna ketika urutan startup atau eksekusi dengan hak istimewa diperlukan. Di Linux, aplikasi menggunakan mekanisme autostart desktop per pengguna.
-
Jalankan dengan hak istimewa menggunakan Task Scheduler sebaiknya tetap mati kecuali Anda harus mendikte ke aplikasi administrator. Hak istimewa bukan opsi kinerja; ini mengubah batas keamanan akses keyboard global.
-
Tampilkan dialog konfirmasi autostart berguna saat memvalidasi pengaturan autostart baru atau di komputer bersama. Nonaktifkan hanya ketika startup dipercaya dan harus berjalan tanpa pengawasan.
-
Tampilkan splash screen membantu ketika inisialisasi model/runtime memakan waktu yang cukup lama. Nonaktifkan untuk startup gaya tray yang lebih tenang.
-
Suara siap menandakan bahwa proses startup dan persiapan model telah selesai, terutama saat Voice2Win dimulai dalam keadaan diminimalkan. Nonaktifkan ini di lingkungan yang tenang; sesuaikan durasi dan volume hanya cukup agar terdengar jelas.
-
Minimalkan saat ditutup (default aktif) menjaga pintasan global tetap tersedia setelah menutup jendela utama. Nonaktifkan ini jika tombol tutup jendela seharusnya keluar dari aplikasi.
-
Periksa pembaruan secara otomatis (default aktif) disarankan untuk perbaikan, kompatibilitas model/runtime, dan pembaruan keamanan. Nonaktifkan hanya untuk instalasi yang sengaja dikelola atau offline dan periksa secara manual.
-
Nonaktifkan dialog informasi mingguan menyembunyikan pemberitahuan informasi yang berulang setelah Anda tidak membutuhkannya; ini tidak menonaktifkan pesan fungsional atau kesalahan.
-
Status otomatisasi input Linux adalah informasi diagnostik. Otomatisasi input yang kompatibel dengan X11 didukung; sesi Wayland murni dapat membatasi pintasan global dan penyisipan teks. Jika tidak tersedia, gunakan sesi X11 atau mode kompatibilitas yang ditawarkan oleh lingkungan desktop.
-
Lokasi penyimpanan transkripsi: Pilih folder lokal yang dapat diandalkan. Gunakan lokasi yang terenkripsi untuk diktasi yang sensitif dan pastikan perangkat lunak cadangan/sinkronisasi tidak bertentangan dengan file yang masih sedang ditulis. Drive jaringan yang lambat atau hanya tersedia secara berselang-seling dapat menunda operasi riwayat.
-
Hapus transkripsi lama / usia maksimum: Aktifkan retensi otomatis ketika kebijakan privasi atau penggunaan disk menjadi penting. Pilih usia yang masih mencakup jendela koreksi dan retranskripsi yang realistis. File WAV yang tersimpan biasanya adalah bagian terbesar dari riwayat.
-
Lokasi penyimpanan model: Pilih SSD lokal yang cepat dengan cukup ruang kosong. Drive yang dapat dilepas dan drive jaringan membuat pemuatan model menjadi kurang andal dan dapat mengubah drive yang terputus menjadi model yang tampaknya hilang.
-
Gunakan root data kustom / pindahkan semua data aplikasi: Berguna untuk pengaturan portabel, cadangan terkontrol, atau menjaga data besar agar tidak berada di drive sistem. Pilih folder dengan izin dan ruang kosong yang sesuai, lalu mulai ulang saat diminta. Ini memindahkan data lokal; ini tidak mengenkripsinya atau mengunggahnya secara otomatis.
Transkripsi waktu nyata adalah pratinjau saat Anda masih berbicara. Transkripsi akhir normal tetap menjadi hasil yang sah. Biarkan mode waktu nyata nonaktif ketika pratinjau tidak berguna: ini meminimalkan penggunaan sumber daya dan menghindari kata-kata awal yang berubah di layar.
- Blok menjalankan model transkripsi utama Whisper secara berulang pada audio yang tumpang tindih. Pilih ini ketika Anda ingin pratinjau menyerupai hasil akhir Whisper dan memiliki GPU yang didukung dengan memori yang cukup. Ini memberikan lebih banyak konteks tetapi menghasilkan pekerjaan GPU yang berulang secara signifikan.
- Stream menggunakan model streaming Sherpa-ONNX terpisah. Pilih ini untuk umpan balik inkremental paling awal atau ketika mode blok tidak tersedia. Pratinjau ini bisa lebih kasar dan hanya mendukung bahasa yang tercantum dalam pengaturan; transkripsi normal akhir tetap bisa berbeda.
- Tinggi tampilan maksimum membatasi seberapa banyak layar yang dapat ditempati oleh pratinjau. Tingkatkan untuk penggunaan aksesibilitas bentuk panjang; kurangi ketika indikator menutupi aplikasi target. Ini tidak mengubah kualitas pengenalan.
Defaultnya seimbang dan saling bergantung. Kembalikan ke pengaturan default sebelum memecahkan masalah dan ubah hanya satu parameter pada satu waktu.
-
Ukuran jendela (default 10 s): Tingkatkan ketika konteks kalimat tidak memadai atau frasa panjang berubah terlalu banyak antara snapshot. Jendela yang lebih besar membutuhkan waktu lebih lama dan menggunakan lebih banyak komputasi/memori. Kurangi untuk pembaruan individu yang lebih cepat pada perangkat keras yang mumpuni, meskipun konteks menjadi lebih sedikit.
-
Interval hop (default 3 s): Kurangi untuk pembaruan pratinjau lebih sering; tingkatkan ketika beban GPU terlalu tinggi. Hop yang lebih kecil memulai lebih banyak jalannya transkripsi dan tidak membuat setiap jalannya lebih cepat.
-
Overlap / konteks (default 20 s): Tingkatkan ketika kata-kata di batas blok digandakan, terlewat, atau digabung dengan buruk. Kurangi untuk mengurangi pekerjaan yang ulang. Overlap yang terlalu sedikit menghilangkan bukti yang diperlukan untuk menyelaraskan snapshot yang berdekatan.
-
Penundaan stabilitas (default 6 s): Tingkatkan saat kata-kata diketik terlalu cepat dan konteks berikutnya seharusnya bisa memperbaikinya. Kurangi saat teks stabil muncul terlalu lambat, menerima lebih banyak revisi.
-
Batas waktu diam (default 1000 ms): Kurangi saat teks harus cepat stabil setelah jeda. Tingkatkan saat ragu-ragu alami memisahkan atau menyelesaikan pikiran terlalu cepat.
-
Pemeriksaan tambahan batas kalimat (default 2): Tingkatkan hanya saat transisi kalimat berulang kali salah dan GPU masih memiliki kapasitas. Setiap transkripsi tambahan memerlukan waktu. Atur ke 0 untuk menonaktifkan pemeriksaan tambahan; pemeriksaan batas utama tetap ada.
-
Faktor geser (default 20%): Mengontrol seberapa jauh jendela verifikasi tambahan bergerak relatif terhadap ukuran jendela. Tingkatkan ini ketika memeriksa area yang lebih luas di sekitar batas membantu; kurangi ketika konteks di sekitarnya sudah cukup. Ini hanya penting bila digunakan bersama pemeriksaan tambahan.
- Runtime: CPU menawarkan kompatibilitas paling luas. DirectML dapat mengurangi latensi pada GPU Windows yang didukung tetapi menggunakan sumber daya GPU yang mungkin juga dibutuhkan oleh model utama.
- Varian model: Pilih Fast untuk latensi rendah dan penggunaan sumber daya yang lebih sedikit. Pilih Accurate ketika kualitas pratinjau lebih penting daripada kecepatannya.
- Jendela perbaikan kalimat (1–8, default 2): Nilai 1 memberikan finalisasi kalimat tercepat. Nilai yang lebih besar menyimpan lebih banyak konteks kalimat untuk perbaikan tetapi menunda penyelesaian dan meningkatkan beban kerja. Default adalah keseimbangan yang praktis.
- Model yang di-cache: Menghapus model yang di-cache dan tidak digunakan membebaskan ruang disk. Jika kombinasi bahasa/runtime/model tersebut dipilih kemudian, model harus diunduh lagi sebelum pratinjau siap.
Lihat Transkripsi Waktu Nyata untuk alur kerja lengkap dan persyaratan ketersediaan.
- Whisper adalah pilihan umum untuk dukungan bahasa yang luas dan varian model yang telah mapan. Parakeet bisa menarik ketika bahasa yang didukung dan perangkat keras yang tersedia sesuai dengan kasus penggunaan Anda. Pilih berdasarkan rekaman nyata Anda; peringkat bintang dan perkiraan kecepatan adalah panduan, bukan pengganti pengujian mikrofon, bahasa, dan kosakata Anda.
- Model yang lebih besar atau berkualitas lebih tinggi umumnya membutuhkan lebih banyak memori dan waktu tetapi dapat meningkatkan kualitas audio yang sulit. Mulailah dengan model terkecil yang akurat secara andal. Model yang menyebabkan tekanan memori atau antrean panjang dapat kurang berguna dibandingkan model yang sedikit lebih kecil yang selesai secara konsisten.
- Manajer model mengunduh dan menghapus file model lokal. Jangan menghapus model yang masih diperlukan oleh mesin yang dipilih atau alur kerja offline.
-
Tugaskan transkripsi audio dan peningkatan AI secara terpisah. GPU biasanya terbaik untuk pekerjaan lokal yang berulang; CPU adalah cadangan untuk kompatibilitas tetapi bisa jauh lebih lambat. Memisahkan kedua tugas di perangkat berbeda dapat menghindari pertentangan memori GPU ketika keduanya digunakan secara bersamaan.
-
Untuk Ollama atau LM Studio, pilih jenis server, alamat, port, dan model yang dimuat. Gunakan penemuan hanya pada jaringan yang terpercaya dan pastikan bahwa model yang dipilih benar-benar tersedia di server.
-
Server AI jarak jauh atau komputer Voice2Win lain dapat memindahkan pekerjaan dari mesin yang lebih lemah, tetapi memperkenalkan latensi jaringan dan mengirim audio atau teks tugas ke sistem tersebut. Gunakan hanya host dan jaringan yang dipercaya.
-
Bagikan runtime lokal hanya ketika instalasi Voice2Win lain yang tepercaya membutuhkannya. Gunakan kata sandi, izinkan port melalui firewall hanya pada profil jaringan yang dimaksud, dan nonaktifkan berbagi ketika tidak lagi diperlukan. Peringatan klien yang terhubung dan versi membantu mengidentifikasi klien yang tidak terduga atau tidak kompatibel.
-
Ukuran konteks (default 4096): Tingkatkan ini untuk teks yang panjang, instruksi panjang, atau transformasi yang membutuhkan konteks sekitarnya lebih banyak. Konteks yang lebih besar mengonsumsi lebih banyak memori dan bisa lebih lambat. Ini tidak otomatis memperbaiki koreksi teks pendek.
-
Token maksimum (default 512): Tingkatkan ini ketika penulisan ulang panjang terpotong. Kurangi untuk membatasi waktu respons dan mencegah output yang secara tidak terduga panjang. Koreksi dikte normal jarang membutuhkan nilai yang sangat besar.
-
Temperatur (default 0.2): Nilai rendah lebih mudah diulang dan paling baik untuk koreksi, pemformatan, dan mempertahankan makna. Tingkatkan hanya untuk penulisan ulang kreatif yang disengaja; nilai yang lebih tinggi dapat mengubah kata-kata atau fakta dengan lebih bebas.
-
Panjang transkripsi minimum untuk peningkatan AI (default 20 karakter): Turunkan ketika frasa yang sangat pendek pun perlu diproses. Tingkatkan untuk menghindari startup/latensi model dan penulisan ulang yang mengejutkan untuk input kecil seperti “ya” atau sebuah nama.
-
Prompt sistem: Ini adalah instruksi tetap untuk peningkatan AI default. Nyatakan bahasa yang diinginkan, apakah makna dan nada harus dipertahankan, dan hanya teks akhir yang harus dikembalikan. Uji perubahan prompt pada teks yang tidak kritis: prompt yang terlalu luas dapat menjawab dikte, menerjemahkannya, atau menambahkan penjelasan alih-alih mengoreksinya.
-
Penyimpanan model AI alternatif: Gunakan drive lokal yang cepat dengan ruang yang memadai. Menyalin model yang ada mencegah pengunduhan ulang; mengganti folder saja tidak membuat model yang hilang atau tidak kompatibel dapat digunakan.
Lihat Model AI dan Perangkat Keras dan Peningkatan AI.
-
Kualitas model pengenal pembicara: Pilih model dengan kualitas lebih tinggi ketika penting untuk memisahkan suara yang mirip dan mesin memiliki cukup memori/kinerja. Gunakan model yang lebih ringan untuk sesi panjang pada perangkat keras terbatas. Model yang diunduh langsung dapat dipilih.
-
Sensitivitas pemisahan pembicara: Mulai dengan Default. Tingkatkan jika dua suara berbeda namun mirip sering digabung; konsekuensinya adalah suara satu orang yang berubah, jarak, atau sudut mikrofon dapat terbagi menjadi pembicara tambahan. Kurangi jika satu orang sering ditampilkan sebagai beberapa pembicara; konsekuensinya adalah suara yang benar-benar mirip mungkin digabung.
-
Sensitivitas deteksi suara: Tingkatkan saat klik, kebisingan ruangan, atau blok sunyi ditranskrip. Kurangi saat pembicara yang tenang diabaikan. Gerbang ini memutuskan apakah sebuah blok akan dikirim untuk transkripsi; blok yang ditolak secara agresif tidak dapat dipulihkan oleh model transkripsi yang lebih akurat.
-
Jeda finalisasi (default 10 s, di halaman Perekaman Percakapan): Gunakan jeda yang lebih pendek ketika bagian harus ditutup dengan cepat setelah pembicara berhenti. Gunakan jeda yang lebih panjang untuk diskusi yang reflektif dengan jeda panjang; hasil muncul kemudian, tetapi satu kontribusi kemungkinan kecil terbagi.
-
Pembicara yang Diharapkan (Otomatis secara default, di halaman Perekaman Percakapan): Biarkan Otomatis ketika peserta dapat bergabung atau meninggalkan. Tetapkan jumlah yang diketahui untuk pertemuan tetap ketika pengelompokan otomatis menghasilkan jumlah yang salah. Jumlah tetap yang salah dapat memaksa suara yang tidak terkait untuk digabungkan atau membagi satu suara untuk memenuhi jumlah yang diminta.
Pemisahan pembicara bersifat probabilistik. Jarak mikrofon, tumpang tindih, gema, dan perubahan suara latar menjadi faktor penting; koreksi pembicara secara manual masih mungkin diperlukan. Lihat Perekaman Percakapan.
Bagian khusus pengembang ini mengatur klien pendamping desktop terpisah yang menyiarkan mikrofon dari komputer lain dalam jaringan lokal yang sama.
-
Aktifkan layanan hanya saat mikrofon klien dibutuhkan. Pilih adaptor jaringan yang dapat dijangkau dari klien; VPN dan adaptor virtual sering menghasilkan alamat pasangan yang tidak dapat dijangkau oleh komputer lain.
-
Pertahankan port default kecuali jika bertentangan dengan layanan lain. Jika klien tidak dapat terhubung, periksa adaptor yang dipilih, firewall lokal, dan apakah kedua sistem berada di jaringan tepercaya yang sama sebelum mengubah port secara acak.
-
Perlakukan URL/token pasangan sebagai rahasia. Siapa pun yang dapat mengakses layanan dan memiliki token yang valid dapat mencoba untuk terhubung. Buat ulang atau sebarkan kembali URL setelah mengubah adaptor, alamat, port, atau token.
-
Status klien yang terhubung menunjukkan klien mana yang tersedia dan kemampuan mereka. Audio diputar dari klien yang dipilih sebagai perangkat perekaman; menghubungkan klien saja tidak membuat setiap mikrofon yang terhubung merekam sekaligus.
-
Tidak ada relay cloud. Ini meningkatkan privasi tetapi berarti pengaturan rute, firewall, mode tidur, dan kualitas Wi-Fi secara langsung memengaruhi ketersediaan dan latensi.
Lihat Companion Client.
- Reproduksi masalah pada satu aplikasi target dengan peningkatan AI dan pratinjau waktu nyata dinonaktifkan.
- Untuk kata yang salah, perbaiki level/mikrofon kebisingan, pilih bahasa tetap, dan uji model transkripsi lain sebelum mengubah pengaturan penyisipan teks.
- Untuk teks yang benar tapi disisipkan dengan salah, ubah metode penyisipan terlebih dahulu, kemudian pintasan tempel, lalu tingkatkan hanya jeda yang relevan.
- Untuk ucapan yang hilang atau pelan, turunkan sedikit sensitivitas deteksi ucapan; untuk kebisingan yang diinterpretasikan sebagai ucapan, naikkan sedikit.
- Untuk beban tinggi, nonaktifkan mode waktu nyata atau tingkatkan interval hop-nya sebelum mengurangi kualitas transkripsi akhir.
- Kembalikan ke default pada bagian yang terkena jika beberapa perubahan membuat hasil sulit diinterpretasikan.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động