-
Notifications
You must be signed in to change notification settings - Fork 0
Limites
martialzinsou edited this page Sep 21, 2026
·
4 revisions
- Un seul agent à la fois : le moteur charge un modèle unique ; une mission ne peut pas tourner en parallèle du chat.
- Les agents bouclent sur le contexte du résultat précédent (pas d'outils externes, pas d'actions sur le système) : ce sont des générateurs/relecteurs autonomes.
- Un agent dont le modèle n'est pas installé est inactif tant que le modèle n'est pas téléchargé.
-
La vision réelle est limitée aux modèles vision +
*.mmproj: les modèles textuels par défaut ne comprennent pas le contenu des images. - Les vidéos et audios attachés ne sont pas analysés par le modèle (aucun décodage vidéo/audio côté moteur) — ils restent des pièces jointes du message.
- La dictée dépend des modèles de reconnaissance vocale macOS (local quand disponibles).
- CPU uniquement : l'app tourne sur le processeur. Les modèles > 3–4 milliards de paramètres deviennent lents, surtout sur Intel.
-
Contexte fixe :
-c 2048tokens. Pas de personnalisation de la longueur de contexte. -
Décodage fixe :
max_tokens = 512,temperature = 0.7. - Port unique : un seul moteur à la fois (un modèle chargé = un chat).
- Premier chargement lent : charger 3+ milliards de paramètres prend plusieurs secondes.
- Le téléchargement initial du moteur et modèles nécessite internet.
- L'API Hugging Face a des quotas (d'où le débounce et la limite des résultats).
- Modèles gated non accessibles (traités comme inaccessibles par le filtre).
- Pas d'historique de conversations persistant.
- Pas de choix du GPU/CPU.
- Pas de fenêtres multiples.
- Pas de gestion de plusieurs moteurs simultanés.
- Réglage de température / max_tokens dans l'interface.
- Choix du fichier de quantification dans la fiche détail avant installation.
- Indicateur de vitesse de génération (tokens/s).
- Historique des conversations (persistance + export).
- Whisper (transcription des fichiers audio et des enregistrements micro) pour traiter réellement l'audio.
- Presets d'agents partageables (export/import JSON).
- Support de plusieurs modèles chargés (switch direct dans le chat).
- Arrêt/relance du moteur sans quitter l'app.
- Barre de progression plus riche (vitesse, fichiers restants UTF).
- Signature et distribution (notarisation) pour diffuser hors build local.
- Aide pour créer des prompts plus efficaces selon la taille du modèle (les petits modèles préfèrent des obligations très courtes).
- Presets de compétences partagées (import/export JSON).
- Benchmarks locaux entre modèles installés.
Les compétences améliorent la forme (structure, ton, format des résultats) mais pas les capacités brutes du modèle : un modèle 0.5 B restera limité sur des tâches très complexes, un 3 B sera nettement meilleur. C'est le bon compromis à garder en tête quand on compare les réponses.
KarenOS ne télverse jamais : ni les conversations, ni les compétences, ni les fichiers de modèle. Seules les requêtes métadonnées (recherche/détails) et les téléchargements depuis Hugging Face sortent de la machine, et ceux-là uniquement quand tu navigues dans la Boutique.
Voir aussi : Dépannage, Compétences.
- Accueil
- Architecture
- Inférence d'un message
- Modèles et Boutique
- Agents autonomes
- Multimodal
- Compétences
- Persistance
- Code source
- Construction & lancement
- Dépannage
- Limites & évolutions
- Home
- Architecture
- Inference of a message
- Models and Store
- Autonomous agents
- Multimodal
- Skills
- Persistence
- Source code
- Build & launch
- Troubleshooting
- Limits & roadmap
Main repository — created by Martial Zinsou