Skip to content

Portugues Brasil Settings Reference

Dan edited this page Aug 22, 2026 · 2 revisions

Referência de configurações

Abra Configurações com o botão de engrenagem. OK salva as alterações; Cancelar descarta-as. Alterações que afetam modelos, tempos de execução, locais de armazenamento ou serviços de rede podem levar um momento para serem aplicadas e podem recarregar um componente.

Esta referência é destinada como um guia de ajuste, não apenas como uma lista de controles. Os padrões são um bom ponto de partida para a maioria das instalações locais do Windows. Altere uma configuração relacionada por vez, teste-a no aplicativo onde você realmente dita, e mantenha o valor anterior até que o resultado seja claramente melhor.

Pontos de partida úteis

Objetivo Ponto de partida recomendado
Ditado confiável no dia a dia em aplicativos de desktop normais Idioma de transcrição fixo, inserção via Área de transferência, restauração da área de transferência ativada, atrasos padrão, normalização de áudio ativada
Ditado em um terminal ou desktop remoto Experimente Unicode primeiro se o encaminhamento da área de transferência não estiver disponível. Caso contrário, mantenha Área de transferência e selecione o atalho de colar aceito pelo alvo remoto. Use Código de varredura para aplicativos que só respondem de forma confiável a entradas semelhantes a teclas físicas.
Documentos longos Idioma fixo, pontuação falada, formatação encadeada, modo de tecla de atalho latched ou híbrido, gravações WAV salvas
Campos de pesquisa curtos, bate-papo e comandos Remova o ponto final no final; opcionalmente use formatação com primeira letra em minúscula; o modo de tecla de atalho pressionada evita sair da gravação acidentalmente

| Uso silencioso ou sensível à privacidade | Desative gravações WAV salvas, revise a retenção de transcrições, desative a inserção na área de transferência se aplicativos que monitoram a área de transferência forem uma preocupação e evite execuções remotas | | Menor latência percebida | Desative a pré-visualização em tempo real, a menos que seja útil, use um modelo/execução de transcrição local rápido, mantenha os atrasos de inserção baixos e não colete a saída de IA antes da inserção |

Transcrição de Áudio

Idioma e termos especializados

  • Idioma de transcrição: Selecione o idioma que você mais fala. Um idioma fixo normalmente inicia mais rápido e é mais confiável do que Automático, especialmente para ditados curtos, nomes e palavras que soam similares. Use a detecção automática apenas quando você realmente alterna de idioma entre gravações; a detecção de idioma tem menos evidência em uma frase curta e pode escolher incorretamente.
  • Termos e nomes especializados personalizados: Adicione nomes pouco comuns, termos de produtos, abreviações e a grafia que você quer que o Whisper prefira. Mantenha a lista focada: ela orienta o reconhecimento, mas não é uma regra de busca e substituição garantida, e uma lista grande de palavras comuns pode introduzir viés indesejado. Esta orientação é destinada ao Whisper; outro motor de transcrição pode não utilizá-la da mesma forma.

Método de inserção de texto

O melhor método de inserção depende da aplicação alvo. Teste-o no programa mais difícil que você usa, não apenas em um editor simples.

  • Área de transferência: A melhor escolha geral no Windows e geralmente a mais rápida para textos longos, caracteres especiais e Unicode complexo. O Voice2Win substitui temporariamente a área de transferência, envia um comando de colar e pode restaurar o conteúdo anterior. Gerenciadores de área de transferência ou outros aplicativos podem observar o texto temporário, e o redirecionamento da área de transferência pode ser desativado em uma sessão remota.

  • Unicode: Independente do layout e uma boa primeira alternativa para sessões remotas, sistemas não-Windows e textos contendo caracteres que não estão presentes no layout do teclado atual. Alguns jogos, terminais, aplicativos legados e janelas com privilégios elevados não aceitam Unicode simulado de forma confiável.

  • Código de Varredura: Funciona mais como a entrada de um teclado físico e pode ajudar com aplicativos antigos ou incomuns. Depende do layout de teclado ativo; um caractere que não tenha uma tecla correspondente nesse layout pode estar ausente ou incorreto. Geralmente, é mais lento do que um único colar da área de transferência para textos longos.

  • Atraso na simulação do teclado (0–50 ms): Mantenha baixo, a menos que a inserção de Unicode ou Código de Varredura perca ou reordene caracteres. Aumente em pequenos passos para aplicativos lentos, máquinas virtuais ou áreas de trabalho remotas. Esta configuração apenas diminui a velocidade das teclas simuladas; não melhora o reconhecimento de fala.

  • Use a área de transferência para aplicativos de destino problemáticos: Mantenha isso ativado ao usar Unicode ou código de varredura, a menos que o uso da área de transferência seja proibido. O Voice2Win poderá então recorrer a aplicativos conhecidos que não aceitam bem a entrada simulada. Desative-o apenas quando a privacidade da área de transferência ou o encaminhamento da área de transferência forem o motivo pelo qual você escolheu deliberadamente a simulação do teclado.

Detalhes da inserção da área de transferência

  • Tempo de espera antes da inserção (0–2000 ms, padrão 40 ms): Tempo necessário para que o novo valor da área de transferência esteja disponível antes de enviar o atalho de colar. Aumente este tempo quando o destino ocasionalmente cola o valor anterior da área de transferência ou nada, especialmente em sincronização remota da área de transferência. Um valor maior adiciona o mesmo atraso a cada inserção.

  • Combinação de teclas para colar: Use Ctrl+V para aplicativos normais do Windows. Experimente Ctrl+Shift+V ou Shift+Insert quando um terminal, desktop remoto ou ferramenta de IA tratar o Ctrl+V como algo diferente de colar texto simples. Escolha o atalho esperado pelo destino final, não necessariamente pela janela local do desktop remoto.

  • Coletar texto durante o aprimoramento da IA e inseri-lo em uma única etapa: Ative isso quando a saída progressiva da IA mover o cursor, disparar formatação ou autocompletar, ou criar várias etapas de desfazer. Desative quando for mais importante ver o resultado o quanto antes; a coleta espera até que o resultado da IA esteja completo antes de qualquer inserção.

  • Restaurar área de transferência anterior: Mantenha isso ativado para trabalho normal para que o Voice2Win não destrua o que você copiou antes da ditado. Desative-o somente se você quiser intencionalmente que o resultado ditado permaneça na área de transferência ou se um destino específico ler a área de transferência após o atalho de colar já ter sido retornado.

  • Tempo de espera antes de restaurar (0–2000 ms, padrão 120 ms): Aumente este valor quando o destino não insere nada ou insere apenas parte do texto porque o valor anterior da área de transferência é restaurado muito rapidamente. Mantenha-o apenas tão alto quanto necessário: durante este intervalo, o texto ditado permanece disponível para aplicativos que reconhecem a área de transferência.

Formatação de ditado

Estas opções modificam o texto reconhecido antes da inserção. Elas são mais úteis quando seus ditados seguem um padrão consistente.

  • Pontuação falada: Ative-a para textos mais longos quando você quiser que palavras como “vírgula”, “ponto de interrogação” ou seus equivalentes específicos do idioma sejam convertidas em pontuação. Deixe desativado quando essas palavras podem ser conteúdo literal ou quando você preferir a pontuação automática do modelo de transcrição.

  • Remover ponto final: Útil para campos de pesquisa, mensagens de chat, campos de formulário, nomes de arquivos e comandos de voz onde um ponto final adicionado automaticamente é indesejado. Deixe desativado para frases completas em documentos e e-mails.

  • Primeira letra minúscula: Útil quando a ditadura é normalmente inserida no meio de uma frase existente. Deixe desativado para novas frases, títulos, nomes e mensagens independentes.

  • Conectar ditados consecutivos no mesmo aplicativo: Ative esta opção quando você construir um parágrafo a partir de várias gravações; o Voice2Win pode manter o espaçamento e o contexto das frases entre elas. Desative-a quando gravações consecutivas normalmente vão para campos diferentes, ou quando você frequentemente move o cursor manualmente entre os ditados.

Detecção e gravação de voz

  • Sensibilidade de detecção de fala (0–100, padrão 35%): Valores mais baixos aceitam fala mais baixa, mas também podem tratar respiração, cliques ou ruído de fundo como fala. Valores mais altos filtram ruído de forma mais agressiva, mas podem rejeitar uma voz suave ou o final das palavras. Comece com o valor padrão e altere em pequenos passos enquanto observa o nível de entrada; aproximar o microfone costuma ser melhor do que usar um valor extremo.

  • Limpeza do início da gravação (0–500 ms, padrão 250 ms): Suprime o clique do atalho, ruído de manuseio e silêncio inicial no começo. Aumente se a primeira parte das gravações contiver o clique da tecla; reduza se a primeira sílaba for cortada ou se você ditar palavras muito curtas imediatamente após pressionar o atalho.

  • Normalizar gravação (ativado por padrão, alvo 85%): Recomendado para microfones comuns e mudança da distância de fala, pois apresenta um nível mais consistente para o modelo. Desative-o para uma entrada de estúdio/virtual já normalizada, ou quando a normalização aumenta perceptivelmente o ruído de fundo constante. O alvo não é um controle de ganho do microfone e não pode recuperar áudio com corte (clipping).

  • Salvar gravações WAV (ativado por padrão): Mantenha ativado quando você quiser reprodução, retranscrição, comparação de qualidade ou evidência diagnóstica. Desative quando o uso de armazenamento ou a confidencialidade forem mais importantes. O áudio normalmente consome muito mais espaço que o texto.

  • Excluir gravações WAV salvas: Remove o áudio armazenado mantendo o texto da transcrição. Use após confirmar que você não precisa mais de reprodução ou retranscrição; a exclusão não pode recriar o áudio original.

Combinação de teclas

Modo de gravação

  • Segurar: A gravação dura apenas enquanto o atalho estiver pressionado. Melhor para ditados curtos e frequentes e o modo mais seguro quando se deve evitar gravações acidentais em segundo plano.
  • Trava: Pressione uma vez para iniciar e novamente para parar. Melhor para longos trechos, uso de acessibilidade ou fala sem usar as mãos, mas requer uma ação deliberada para parar.
  • Híbrido / toque duplo: Segure para uma gravação curta ou toque duas vezes para travar. Este é o padrão mais flexível para trabalhos mistos. Use Segurar no lugar se toques duplos acidentais às vezes deixarem a gravação ativa.

Atalho e opções de feedback

  • Atribua atalhos separados para Fala para Texto e Comando de Voz. Prefira combinações que não sejam já utilizadas pelo sistema operacional, driver de teclado, área de trabalho remota ou aplicativo alvo. Atalhos duplicados do Voice2Win são rejeitados.

  • No Windows, o Voice2Win geralmente não consegue injetar em um aplicativo que esteja sendo executado com privilégios mais altos. Execute o Voice2Win com privilégios elevados apenas quando a ditado em aplicativos elevados for realmente necessário; o acesso global elevado aumenta o impacto de qualquer erro de aplicativo ou configuração.

  • Silenciar a saída de áudio global enquanto a tecla de atalho estiver pressionada é útil com alto-falantes porque o áudio do sistema não é retornado ao microfone. Desative isso ao usar fones de ouvido ou quando for necessário ouvir uma reunião ou fonte de mídia durante a gravação.

  • Sinais de início e parada separados tornam o estado de travamento/híbrido claro quando o indicador não está visível. Mantenha os sons curtos e baixos ao usar alto-falantes para que o microfone não os capte. Aumente a duração ou o volume para acessibilidade, não para resolver a detecção instável de tecla de atalho.

Geral

Display

  • Idioma da interface altera apenas os menus e rótulos; não seleciona o idioma da transcrição.
  • Tema escuro é uma preferência visual e não afeta o reconhecimento ou desempenho.
  • Estilo do indicador: um display de nível simples é o menos distrativo; formas de onda ou barras facilitam julgar a atividade da fala; displays no estilo espectro mostram mais detalhes, mas são visualmente mais ocupados. Escolha o estilo que ajuda você a confirmar a atividade do microfone sem cobrir o aplicativo alvo.
  • Esquema de cores, posição e tamanho: Use um esquema de alto contraste e uma posição longe de barras de ferramentas, legendas e do cursor de texto. Um indicador maior ajuda na acessibilidade e no texto em tempo real; um menor é melhor quando apenas o estado da gravação importa.

Comportamento do aplicativo

  • Autostart desativado é o melhor quando o Voice2Win é usado ocasionalmente. Autostart pelo registro é a escolha normal do Windows para iniciar após o login. Agendador de Tarefas é útil quando a ordem de inicialização ou a execução elevada é necessária. No Linux, o aplicativo utiliza o mecanismo de autostart por usuário da área de trabalho.

  • Executar com privilégios elevados pelo Agendador de Tarefas deve permanecer desligado, a menos que você precise ditar em aplicativos de administrador. Elevação não é uma opção de desempenho; ela altera a fronteira de segurança do acesso global ao teclado.

  • Mostrar diálogo de confirmação de autostart é útil ao validar uma nova configuração de inicialização automática ou em um computador compartilhado. Desative-o apenas quando a inicialização for confiável e deva ser automática.

  • Mostrar tela de abertura (splash screen) ajuda quando a inicialização do modelo/runtime leva um tempo perceptível. Desative-o para uma inicialização mais silenciosa, no estilo bandeja.

  • Som de pronto confirma que a inicialização e a preparação do modelo estão completas, particularmente quando o Voice2Win inicia minimizado. Desative-o em ambientes silenciosos; ajuste a duração e o volume apenas o suficiente para ser reconhecível.

  • Minimizar ao fechar (ativado por padrão) mantém os atalhos globais disponíveis após fechar a janela principal. Desative-o quando o botão de fechar da janela deve encerrar a aplicação em vez disso.

  • Verificar atualizações automaticamente (ativado por padrão) é recomendado para correções, compatibilidade de modelo/runtime e atualizações de segurança. Desative-o apenas para instalações deliberadamente gerenciadas ou offline e verifique manualmente em vez disso.

  • Desativar diálogo informativo semanal oculta o aviso informativo recorrente depois que você não precisar mais dele; não desativa mensagens funcionais ou de erro.

  • Status da automação de entrada do Linux é informação de diagnóstico. A automação de entrada compatível com X11 é suportada; uma sessão puramente Wayland pode restringir atalhos globais e injeção de texto. Se não estiver disponível, use uma sessão X11 ou o modo de compatibilidade oferecido pelo ambiente de área de trabalho.

Locais de armazenamento e retenção

  • Caminho de armazenamento das transcrições: Escolha uma pasta local confiável. Use um local criptografado para ditados sensíveis e certifique-se de que o software de backup/sincronização não entre em conflito com arquivos que ainda estão sendo gravados. Um drive de rede lento ou intermitente pode atrasar as operações de histórico.

  • Excluir transcrições antigas / idade máxima: Ative a retenção automática quando políticas de privacidade ou uso de disco forem importantes. Escolha uma idade que ainda cubra sua janela realista de correção e retranscrição. Arquivos WAV salvos normalmente representam a maior parte do histórico.

  • Caminho de armazenamento do modelo: Prefira um SSD local rápido com espaço livre suficiente. Drives removíveis e de rede tornam o carregamento do modelo menos confiável e podem transformar um drive desconectado em um modelo aparentemente ausente.

  • Use uma raiz de dados personalizada / mova todos os dados do aplicativo: Útil para configurações portáteis, backups controlados ou para manter grandes volumes de dados fora da unidade do sistema. Selecione uma pasta com permissões adequadas e espaço livre, e reinicie quando solicitado. Isso realoca os dados locais; não os criptografa nem faz upload automaticamente.

Transcrição em Tempo Real

A transcrição em tempo real é uma pré-visualização enquanto você ainda está falando. A transcrição final normal continua sendo o resultado autoritativo. Mantenha o modo em tempo real desativado quando uma pré-visualização não for útil: isso minimiza o uso de recursos e evita que palavras preliminares mudem na tela.

Escolhendo um modo

  • Bloco executa repetidamente o modelo principal de transcrição Whisper sobre áudio sobreposto. Escolha esta opção quando você quiser que a pré-visualização se aproxime do resultado final do Whisper e tiver uma GPU compatível com memória suficiente. Ele fornece mais contexto, mas gera um trabalho substancial repetido na GPU.
  • Transmissão utiliza um modelo de streaming Sherpa-ONNX separado. Escolha esta opção para obter o feedback incremental mais rápido ou quando o modo bloco não estiver disponível. Sua pré-visualização pode ser mais rudimentar e suporta apenas os idiomas listados nas configurações; a transcrição final normal ainda pode diferir.
  • Altura máxima de exibição limita quanto da tela a pré-visualização pode ocupar. Aumente-a para uso acessível de longa duração; reduza quando o indicador cobrir o aplicativo alvo. Isso não altera a qualidade do reconhecimento.

Parâmetros de bloco

Os padrões são equilibrados e interdependentes. Restaure-os antes de solucionar problemas e altere apenas um parâmetro por vez.

  • Tamanho da janela (padrão 10 s): Aumente quando o contexto da frase for insuficiente ou quando frases longas mudarem muito entre snapshots. Janelas maiores demoram mais e usam mais processamento/memória. Reduza para atualizações individuais mais rápidas em hardware capaz, aceitando menos contexto.

  • Intervalo de salto (padrão 3 s): Reduza para atualizações de pré-visualização mais frequentes; aumente quando a carga da GPU estiver muito alta. Um salto menor inicia mais execuções de transcrição e não torna cada execução mais rápida.

  • Sobreposição / contexto (padrão 20 s): Aumente quando palavras nas bordas de blocos forem duplicadas, omitidas ou fundidas de forma inadequada. Reduza para diminuir trabalho repetido. Sobreposição muito pequena remove evidências necessárias para reconciliar snapshots adjacentes.

  • Atraso de estabilidade (padrão 6 s): Aumente-o quando as palavras são comprometidas cedo demais e o contexto posterior poderia tê-las corrigido. Reduza-o quando o texto estável aparece muito lentamente, aceitando mais revisões.

  • Limite de tempo de silêncio (padrão 1000 ms): Reduza-o quando o texto deve se estabilizar rapidamente após uma pausa. Aumente-o quando hesitações naturais dividem ou finalizam pensamentos cedo demais.

  • Verificações adicionais de limite de sentença (padrão 2): Aumente apenas quando as transições de frase estão repetidamente erradas e houver capacidade de GPU disponível. Cada transcrição extra deslocada custa tempo. Defina como 0 para desativar as execuções extras; a verificação central do limite ainda permanece.

  • Fator de deslocamento (padrão 20%): Controla o quanto as janelas de verificação adicionais se movem em relação ao tamanho da janela. Aumente quando verificar uma área maior em torno de um limite ajuda; reduza quando o contexto próximo for suficiente. Isso importa apenas junto com verificações adicionais.

Parâmetros de fluxo e modelos em cache

  • Tempo de execução: CPU oferece a compatibilidade mais ampla. DirectML pode reduzir a latência em GPUs Windows compatíveis, mas utiliza recursos de GPU que também podem ser necessários pelo modelo principal.
  • Variante do modelo: Escolha Rápido para baixa latência e menor uso de recursos. Escolha Preciso quando a qualidade da pré-visualização for mais importante que a velocidade.
  • Janela de refinamento de frase (1–8, padrão 2): Um valor de 1 proporciona a finalização de frase mais rápida. Valores maiores mantêm mais contexto da frase para refinamento, mas atrasam a conclusão e aumentam o trabalho. O padrão é um equilíbrio prático.
  • Modelos em cache: Excluir um modelo em cache não utilizado libera espaço em disco. Se essa combinação de idioma/tempo de execução/modelo for selecionada posteriormente, será necessário baixá-lo novamente antes que a pré-visualização esteja disponível.

Veja Transcrição em Tempo Real para o fluxo completo de trabalho e requisitos de disponibilidade.

Modelos de IA

Motor de transcrição e modelo

  • Whisper é a escolha geral para suporte amplo a idiomas e variantes de modelo estabelecidas. Parakeet pode ser atraente quando os idiomas suportados e o hardware disponível correspondem ao seu caso de uso. Selecione com base nas suas gravações reais; classificações por estrelas e estimativas de velocidade são apenas um guia, não substituem testar seu microfone, idioma e vocabulário.
  • Modelos maiores ou de maior qualidade geralmente precisam de mais memória e tempo, mas podem melhorar áudios difíceis. Comece com o menor modelo que seja confiavelmente preciso o suficiente. Um modelo que causa pressão de memória ou longas filas pode ser menos útil do que um modelo ligeiramente menor que conclua consistentemente.
  • O gerenciador de modelos faz download e remove arquivos de modelos locais. Não exclua um modelo ainda necessário por um motor selecionado ou fluxo de trabalho offline.

Atribuição em tempo de execução

  • Atribua transcrição de áudio e aperfeiçoamento por IA de forma independente. Uma GPU geralmente é a melhor opção para trabalhos locais repetidos; o CPU é a alternativa compatível, mas pode ser muito mais lenta. Dividir as duas tarefas entre dispositivos pode evitar a competição por memória da GPU quando ambos são usados ao mesmo tempo.

  • Para Ollama ou LM Studio, selecione o tipo de servidor, endereço, porta e modelo carregado. Use a descoberta apenas em uma rede confiável e verifique se o modelo escolhido está realmente disponível no servidor.

  • Um servidor de IA remoto ou outro computador Voice2Win pode transferir o trabalho de uma máquina mais fraca, mas introduz latência de rede e envia o áudio ou texto da tarefa para esse sistema. Use apenas hosts e redes confiáveis.

  • Compartilhar runtime local apenas quando outra instalação confiável do Voice2Win precisar dele. Use uma senha, permita a porta no firewall apenas no perfil de rede pretendido e desative o compartilhamento quando não for mais necessário. Avisos de cliente conectado e de versão ajudam a identificar clientes inesperados ou incompatíveis.

Parâmetros de aprimoramento por IA

  • Tamanho do contexto (padrão 4096): Aumente-o para textos selecionados longos, instruções longas ou transformações que precisem de mais contexto ao redor. Um contexto maior consome mais memória e pode ser mais lento. Não melhora automaticamente correções curtas.

  • Máximo de tokens (padrão 512): Aumente-o quando reescritas longas forem cortadas. Reduza-o para limitar o tempo de resposta e evitar saídas inesperadamente longas. Correção normal de ditado raramente precisa de um valor muito alto.

  • Temperatura (padrão 0,2): Valores baixos são mais repetíveis e são melhores para correção, formatação e preservação do significado. Aumente apenas para reescritas deliberadamente criativas; valores mais altos podem alterar a redação ou os fatos com mais liberdade.

  • Comprimento mínimo de transcrição para aprimoramento de IA (padrão 20 caracteres): Reduza-o quando até mesmo frases muito curtas devem ser processadas. Aumente-o para evitar inicialização/latência do modelo e reescritas inesperadas para entradas minúsculas, como “sim” ou um nome.

  • Prompt do sistema: Esta é a instrução permanente para o aprimoramento padrão da IA. Indique o idioma desejado, se o significado e o tom devem ser preservados e que apenas o texto final deve ser retornado. Teste alterações no prompt em textos não críticos: um prompt muito amplo pode responder à ditado, traduzir ou adicionar explicações em vez de corrigi-lo.

  • Armazenamento alternativo de modelos de IA: Use uma unidade local rápida com espaço adequado. Copiar modelos existentes evita outro download; apenas alterar a pasta não torna um modelo ausente ou incompatível utilizável.

Veja Modelos de IA e Hardware e Aprimoramento de IA.

Gravação de Conversa

  • Qualidade do modelo de reconhecimento de falantes: Prefira o modelo de maior qualidade quando for importante separar vozes semelhantes e a máquina tiver memória/desempenho suficientes. Use um modelo mais leve para sessões longas em hardware limitado. Modelos baixados tornam-se selecionáveis imediatamente.

  • Sensibilidade de separação de falantes: Comece com Padrão. Aumente quando duas vozes diferentes, mas semelhantes, forem repetidamente mescladas; o compromisso é que a voz de uma pessoa, distância ou ângulo do microfone em mudança possa ser dividida em falantes extras. Reduza quando uma pessoa for repetidamente mostrada como vários falantes; o compromisso é que vozes genuinamente semelhantes possam ser mescladas.

  • Sensibilidade à detecção de fala: Aumente quando cliques, ruído ambiente ou blocos silenciosos forem transcritos. Reduza quando falantes silenciosos forem omitidos. Este limite decide se um bloco será enviado para transcrição; um bloco rejeitado de forma agressiva não pode ser recuperado por um modelo de transcrição mais preciso.

  • Pausa de finalização (padrão 10 s, na página de Gravação de Conversa): Use uma pausa mais curta quando as seções devem ser encerradas rapidamente após os falantes pararem. Use uma pausa mais longa para discussões reflexivas com longas hesitações; os resultados aparecem depois, mas é menos provável que uma contribuição seja dividida.

  • Oradores esperados (Automático por padrão, na página de Gravação de Conversa): Mantenha Automático quando os participantes puderem entrar ou sair. Defina a contagem conhecida para uma reunião fixa quando a clusterização automática produzir o número errado. Uma contagem fixa incorreta pode forçar vozes não relacionadas a se juntarem ou dividir uma voz para atender à contagem solicitada.

A separação de oradores é probabilística. Distância do microfone, sobreposição, ecos e ruído de fundo variável são fatores importantes; a correção manual do orador ainda pode ser necessária. Veja Gravação de Conversa.

Conexões de clientes

Esta seção apenas para desenvolvedores configura o cliente acompanhante de desktop separado que transmite um microfone de outro computador na mesma rede local.

  • Ative o serviço apenas enquanto os microfones dos clientes forem necessários. Escolha o adaptador de rede que seja acessível pelo cliente; VPNs e adaptadores virtuais frequentemente geram um endereço de emparelhamento que o outro computador não consegue alcançar.

  • Mantenha a porta padrão, a menos que haja conflito com outro serviço. Se o cliente não conseguir se conectar, verifique o adaptador selecionado, o firewall local e se ambos os sistemas estão na mesma rede confiável antes de alterar portas aleatórias.

  • Trate a URL/token de emparelhamento como um segredo. Qualquer pessoa que consiga acessar o serviço e possua um token válido pode tentar se conectar. Regere ou redistribua a URL após alterar o adaptador, endereço, porta ou token.

  • O status de cliente conectado mostra quais clientes estão disponíveis e suas capacidades. O áudio é transmitido a partir do cliente selecionado como dispositivo de gravação; simplesmente conectar um cliente não faz com que todos os microfones conectados gravem ao mesmo tempo.

  • Não há retransmissão na nuvem. Isso melhora a privacidade, mas significa que o roteamento, o firewall, o modo de espera e a qualidade do Wi-Fi afetam diretamente a disponibilidade e a latência.

Veja Cliente Companion.

Uma ordem prática de solução de problemas

  1. Reproduza o problema em uma aplicação-alvo com aprimoramento de IA e pré-visualização em tempo real desativados.
  2. Para palavras erradas, ajuste o nível do microfone/ruído, selecione um idioma fixo e teste outro modelo de transcrição antes de alterar as configurações de inserção de texto.
  3. Para texto correto que é inserido de forma incorreta, altere primeiro o método de inserção, depois o atalho de colar, e então aumente apenas o atraso relevante.
  4. Para fala baixa ausente, diminua ligeiramente a sensibilidade de detecção de fala; para ruído interpretado como fala, aumente-a ligeiramente.
  5. Para alta carga, desative o modo em tempo real ou aumente seu intervalo de salto antes de reduzir a qualidade final da transcrição.
  6. Restaure os padrões na seção afetada se várias alterações tornaram o resultado difícil de interpretar.
Languages
English

Features

Configuration

Help

Deutsch

Funktionen

Konfiguration

Hilfe

Español

Funciones

Configuración

Ayuda

Français

Fonctionnalités

Configuration

Aide

Português (Brasil)

Recursos

Configuração

Ajuda

Italiano

Funzionalità

Configurazione

Aiuto

Nederlands

Functies

Configuratie

Help

Polski

Funkcje

Konfiguracja

Pomoc

Svenska

Funktioner

Konfiguration

Hjälp

简体中文

功能

配置

帮助

日本語

機能

設定

ヘルプ

한국어

기능

구성

도움말

हिन्दी

सुविधाएँ

कॉन्फ़िगरेशन

सहायता

繁體中文

功能

設定

說明

Bahasa Indonesia

Fitur

Konfigurasi

Bantuan

Tiếng Việt

Tính năng

Cấu hình

Trợ giúp

ไทย

คุณสมบัติ

การกำหนดค่า

วิธีใช้

العربية

الميزات

الإعداد

المساعدة

Türkçe

Özellikler

Yapılandırma

Yardım

Русский

Возможности

Настройка

Справка

Українська

Функції

Налаштування

Довідка

Clone this wiki locally