v1.2.0
v1.2.0 — Raciocínio longo sem travar, e mais controle
Corrigido
Pico de memória durante raciocínio longo. O bloco de raciocínio era reescrito
por inteiro a cada token que chegava. Como innerText recria os nós de texto e o
scroll logo em seguida força um reflow síncrono, o custo crescia com o quadrado do
tamanho do texto — num raciocínio realmente longo o app inchava e a interface
parava de responder até o fim da geração.
Agora só o trecho novo é anexado, uma vez por quadro, e o bloco exibido tem um teto
de 200 mil caracteres. De quebra, o título da janela deixou de ser reenviado ao
processo principal a cada token.
Medido com o app real, mesmo fluxo de 15 mil tokens: antes a interface congelava e
não voltava; agora termina normalmente com cerca de 5 MB de variação de memória.
Novo
Nível de raciocínio ajustável (Configurações → Ajustes). Dá para pedir que o
modelo pense mais, menos ou nada:
| Nível | O que é enviado ao servidor |
|---|---|
| Padrão do modelo | nada — funciona em qualquer servidor |
| Desligado | enable_thinking: false + /no_think no prompt |
| Baixo / Médio / Alto | reasoning_effort: low | medium | high |
O padrão não acrescenta campo nenhum à requisição de propósito: reasoning_effort
é extensão recente e servidor antigo recusa o que não conhece. Se um nível der erro
de requisição, volte para o padrão. Quem já usava a opção "desativar raciocínio" é
migrado automaticamente para Desligado.
Troca rápida da pasta segura. O botão de pasta no cabeçalho agora abre um menu
com a pasta atual, as usadas recentemente e a opção de escolher outra. Alternar
entre projetos virou um clique, sem passar pelo diálogo do sistema toda vez. Quem
já tem chats abertos encontra as pastas deles já listadas.
Atualizando
Basta instalar por cima. Suas conversas, configurações e histórico são preservados.
Full Changelog: v1.1.0...v1.2.0