Skip to content

Limites

martialzinsou edited this page Sep 21, 2026 · 4 revisions

Limites & évolutions

Limites actuelles

Côté agents

  • Un seul agent à la fois : le moteur charge un modèle unique ; une mission ne peut pas tourner en parallèle du chat.
  • Les agents bouclent sur le contexte du résultat précédent (pas d'outils externes, pas d'actions sur le système) : ce sont des générateurs/relecteurs autonomes.
  • Un agent dont le modèle n'est pas installé est inactif tant que le modèle n'est pas téléchargé.

Côté multimodal

  • La vision réelle est limitée aux modèles vision + *.mmproj : les modèles textuels par défaut ne comprennent pas le contenu des images.
  • Les vidéos et audios attachés ne sont pas analysés par le modèle (aucun décodage vidéo/audio côté moteur) — ils restent des pièces jointes du message.
  • La dictée dépend des modèles de reconnaissance vocale macOS (local quand disponibles).

Côté moteur

  • CPU uniquement : l'app tourne sur le processeur. Les modèles > 3–4 milliards de paramètres deviennent lents, surtout sur Intel.
  • Contexte fixe : -c 2048 tokens. Pas de personnalisation de la longueur de contexte.
  • Décodage fixe : max_tokens = 512, temperature = 0.7.
  • Port unique : un seul moteur à la fois (un modèle chargé = un chat).
  • Premier chargement lent : charger 3+ milliards de paramètres prend plusieurs secondes.

Côté réseau

  • Le téléchargement initial du moteur et modèles nécessite internet.
  • L'API Hugging Face a des quotas (d'où le débounce et la limite des résultats).
  • Modèles gated non accessibles (traités comme inaccessibles par le filtre).

Côté application

  • Pas d'historique de conversations persistant.
  • Pas de choix du GPU/CPU.
  • Pas de fenêtres multiples.
  • Pas de gestion de plusieurs moteurs simultanés.

Évolutions possibles

Court terme

  • Réglage de température / max_tokens dans l'interface.
  • Choix du fichier de quantification dans la fiche détail avant installation.
  • Indicateur de vitesse de génération (tokens/s).
  • Historique des conversations (persistance + export).
  • Whisper (transcription des fichiers audio et des enregistrements micro) pour traiter réellement l'audio.
  • Presets d'agents partageables (export/import JSON).

Moyen terme

  • Support de plusieurs modèles chargés (switch direct dans le chat).
  • Arrêt/relance du moteur sans quitter l'app.
  • Barre de progression plus riche (vitesse, fichiers restants UTF).
  • Signature et distribution (notarisation) pour diffuser hors build local.

Idées plus larges

  • Aide pour créer des prompts plus efficaces selon la taille du modèle (les petits modèles préfèrent des obligations très courtes).
  • Presets de compétences partagées (import/export JSON).
  • Benchmarks locaux entre modèles installés.

Compétences : ce qu'il faut savoir

Les compétences améliorent la forme (structure, ton, format des résultats) mais pas les capacités brutes du modèle : un modèle 0.5 B restera limité sur des tâches très complexes, un 3 B sera nettement meilleur. C'est le bon compromis à garder en tête quand on compare les réponses.

Confidentialité — engagement

KarenOS ne télverse jamais : ni les conversations, ni les compétences, ni les fichiers de modèle. Seules les requêtes métadonnées (recherche/détails) et les téléchargements depuis Hugging Face sortent de la machine, et ceux-là uniquement quand tu navigues dans la Boutique.

Voir aussi : Dépannage, Compétences.

Clone this wiki locally