-
Notifications
You must be signed in to change notification settings - Fork 0
Indonesian AI Models and Hardware
Voice2Win memisahkan tiga jenis pekerjaan model. Memahami perbedaan ini membuat pengaturan model dan perangkat keras kecerdasan buatan (AI) menjadi lebih mudah.
| Beban Kerja | Tujuan | Teknologi |
|---|---|---|
| Transkripsi utama | Dikte normal, perintah suara, transkripsi blok, dan retranskripsi | Whisper atau Parakeet |
| Transkripsi aliran | Hasil sementara sangat awal saat merekam | Model online Sherpa-ONNX terpisah |
| Peningkatan AI | Merevisi atau mengubah teks | Model Gemma bawaan, Ollama, LM Studio, atau instance Voice2Win bersama |
Parakeet adalah mesin transkripsi utama, bukan model aliran.
OpenAI Whisper memberikan pengenalan offline yang sangat baik di berbagai bahasa. Ia menggunakan lebih banyak sumber daya dan biasanya lebih lambat daripada Parakeet. Akselerasi kartu grafis direkomendasikan untuk model besar dan transkripsi blok waktu nyata.
NVIDIA Parakeet V3 jauh lebih efisien dan performa baik pada prosesor utama. Mungkin sedikit kurang bebas kesalahan dibandingkan Whisper dan mendukung set bahasa yang lebih kecil. Pilih saat kecepatan dan penggunaan sumber daya yang lebih rendah lebih penting daripada cakupan multibahasa maksimal.
Pengaturan AI Models hanya menampilkan model yang termasuk dalam mesin yang dipilih. Gunakan Kelola Model untuk mengunduh atau menghapus file model. Daftar Model Saat Ini di jendela utama kemudian memilih di antara model yang diunduh.
Tabel penugasan prosesor utama (CPU) / kartu grafis (GPU) dan Model AI menetapkan Transkripsi Audio dan Peningkatan AI secara independen.
- Prosesor utama (CPU) adalah pilihan yang paling kompatibel tetapi mungkin lebih lambat.
- Kartu grafis (GPU) mempercepat beban kerja yang didukung dan menampilkan peringatan kinerja jika beban kerja yang dipilih kemungkinan akan lambat atau kekurangan memori grafis.
- Ollama atau LM Studio dapat menyediakan Peningkatan AI dari server lokal. Masukkan host dan port-nya, cari jaringan Internet Protocol versi 4 (IPv4) lokal jika diinginkan, segarkan daftar model, dan pilih model yang dilaporkan.
- Instansi Voice2Win bersama dapat menyediakan transkripsi audio, Peningkatan AI, atau keduanya dari komputer lain.
Mengganti runtime akan memuat ulang model yang terpengaruh di latar belakang dan dapat memakan waktu.
- Whisper dan peningkatan AI bawaan menggunakan akselerasi grafis Vulkan di Windows dan Linux; macOS menggunakan jalur grafis bawaannya.
- Parakeet dan transkripsi aliran Windows menggunakan DirectML untuk akselerasi grafis.
- Prosesor utama tetap tersedia sebagai cadangan.
Voice2Win sengaja menghindari menggabungkan runtime CUDA karena ukuran paketnya. Driver grafis saat ini dengan dukungan Vulkan atau DirectML lebih penting daripada menginstal CUDA secara terpisah.
Model ucapan dan AI dapat berada di memori secara bersamaan. Kebutuhan memori gabungannya penting:
- Jika memori grafis khusus tidak mencukupi, pilih model yang lebih kecil atau yang terkuantisasi lebih kuat.
- Tunjukkan satu beban kerja ke prosesor utama dan yang lainnya ke kartu grafis.
- Hindari memuat model yang perkiraan peringatannya melebihi memori sistem atau grafis yang tersedia; paging berat dapat membuat seluruh komputer tidak responsif.
- Gunakan lokasi penyimpanan AI-model alternatif ketika kapasitas disk, bukan memori, menjadi keterbatasan.
Ollama menggunakan port default 11434; LM Studio menggunakan port default 1234. Voice2Win menanyakan daftar model server yang dipilih dan mengirimkan prompt peningkatan hanya ke server yang dikonfigurasi tersebut. Ketersediaan server, privasi, dan perilaku model adalah tanggung jawab dari instalasi server tersebut.
Satu komputer Voice2Win dapat mengekspos model bicara dan AI yang sedang dimuat ke instance Voice2Win lainnya:
- Di Pengaturan → Model AI, aktifkan berbagi runtime.
- Pilih port dan opsional kata sandi.
- Di komputer lain, tambahkan instance Voice2Win yang dibagikan, masukkan nama komputer atau alamat IPv4, port, dan kata sandi, atau cari di jaringan lokal.
- Tetapkan Transkripsi Audio dan/atau Peningkatan AI ke baris jarak jauh.
Klien yang terhubung dan informasi penggunaan terakhir ditampilkan di komputer yang berbagi. Pertahankan versi agar selaras; ketidakcocokan versi dapat menyebabkan masalah kompatibilitas. Sebuah instance yang sendiri menggunakan runtime yang dibagikan tidak dapat membagikan runtime tersebut ke lain.
Fitur ini mengirimkan data beban kerja melalui koneksi jaringan yang dikonfigurasi. Gunakan jaringan yang tepercaya dan kata sandi ketika pengguna lain dapat mengakses port.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động