-
Notifications
You must be signed in to change notification settings - Fork 0
Espanol Modelos de IA y hardware
Voice2Win separa tres tipos de tareas de modelos. Comprender la diferencia facilita mucho los ajustes de modelos de inteligencia artificial (IA) y hardware.
| Tarea | Finalidad | Tecnología |
|---|---|---|
| Transcripción principal | Dictado normal, comandos de voz, transcripción por bloques y nueva transcripción | Whisper o Parakeet |
| Transcripción en streaming | Resultados provisionales muy tempranos durante la grabación | Modelo en línea Sherpa-ONNX separado |
| Mejora con IA | Revisa o transforma texto | Modelo Gemma integrado, Ollama, LM Studio o una instancia compartida de Voice2Win |
Parakeet es un motor principal de transcripción, no un modelo de streaming.
OpenAI Whisper ofrece un reconocimiento sin conexión excelente en muchos idiomas. Utiliza más recursos y normalmente es más lento que Parakeet. Se recomienda la aceleración gráfica para modelos grandes y para la transcripción por bloques en tiempo real.
NVIDIA Parakeet V3 es mucho más eficiente y funciona bien en el procesador principal. Puede cometer algo más de errores que Whisper y admite menos idiomas. Elígelo cuando sean más importantes la velocidad y el menor consumo de recursos que la máxima cobertura multilingüe.
Los ajustes de Modelos de IA muestran únicamente los modelos del motor seleccionado. Utiliza Administrar modelos para descargar o eliminar archivos. A continuación, la lista Modelo actual de la ventana principal permite elegir entre los modelos descargados.
La tabla Procesador principal (CPU)/tarjetas gráficas (GPU) y asignación de modelos de IA asigna de forma independiente la Transcripción de audio y la Mejora con IA.
- Procesador principal (CPU) es la opción más compatible, pero puede ser más lenta.
- Tarjeta gráfica (GPU) acelera las tareas compatibles y muestra una advertencia si es probable que la tarea resulte lenta o no disponga de suficiente memoria gráfica.
- Ollama o LM Studio pueden proporcionar Mejora con IA desde un servidor local. Introduce el host y el puerto, busca opcionalmente en la red local con Protocolo de Internet versión 4 (IPv4), actualiza la lista y selecciona un modelo detectado.
- Una instancia compartida de Voice2Win puede proporcionar transcripción de audio, Mejora con IA o ambas desde otro ordenador.
Al cambiar de entorno, el modelo afectado se vuelve a cargar en segundo plano y puede tardar un poco.
- Whisper y la Mejora con IA integrada utilizan aceleración gráfica Vulkan en Windows y Linux; macOS emplea su ruta gráfica nativa.
- Parakeet y la transcripción en streaming de Windows utilizan DirectML para la aceleración gráfica.
- El procesador principal sigue disponible como alternativa.
Voice2Win evita deliberadamente incluir entornos CUDA debido al tamaño de sus paquetes. Es más importante contar con un controlador gráfico actualizado compatible con Vulkan o DirectML que instalar CUDA por separado.
Los modelos de voz e IA pueden estar cargados al mismo tiempo. Importa su consumo combinado:
- Si la memoria gráfica dedicada es insuficiente, elige modelos menores o más cuantizados.
- Asigna una tarea al procesador principal y la otra a la tarjeta gráfica.
- Evita cargar modelos cuya advertencia estime más memoria del sistema o gráfica de la disponible; una paginación intensa puede volver lento todo el ordenador.
- Utiliza la ubicación alternativa para modelos de IA cuando el límite sea el almacenamiento, no la memoria.
Ollama utiliza de forma predeterminada el puerto 11434 y LM Studio el 1234. Voice2Win consulta la lista de modelos del servidor seleccionado y envía los prompts de mejora únicamente al servidor configurado. La disponibilidad, la privacidad y el comportamiento del modelo son responsabilidad de esa instalación.
Un ordenador con Voice2Win puede ofrecer sus modelos de voz e IA cargados a otras instancias:
- En Ajustes → Modelos de IA, activa el uso compartido del entorno.
- Elige un puerto y, opcionalmente, una contraseña.
- En el otro ordenador, añade una instancia compartida de Voice2Win e introduce el nombre o la dirección IPv4, el puerto y la contraseña, o busca en la red local.
- Asigna la Transcripción de audio y/o la Mejora con IA a la fila remota.
El ordenador que comparte muestra los clientes conectados y la última utilización. Mantén las versiones alineadas; una diferencia puede causar problemas de compatibilidad. Una instancia que consume un entorno compartido no puede volver a compartirlo.
Esta función envía los datos de las tareas por la conexión de red configurada. Utiliza una red de confianza y una contraseña si otras personas pueden acceder al puerto.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động