Dans les grandes lignes :
Le sucre autour, c'est Newell qui s'en charge. Et bien qu'il apporte un overhead si on compare à LMstudio, ce dernier (削除) pue fort (削除ここまで) n'est pas libre et d'autre part je suis un fervent supporter de Newell du début et tjs à ce jour :-)
Pour la conf :
llama-server v9748 (livré par l'équipe Newell)
reasoning-format désactivé
reasoning-budget désactivé
semantic-memory activée
gemma-4-e4b.gguf
température à 0
Pénalité de fréquence à 2
Native tools calling
désactivation du TextStreamer pour éviter le "think leak" sans désactiver le "think"
Mmproj activé pour la reconnaissance d'image
accélération matérielle activée
RAG actif / accès à certains dossiers de mes documents
[^] # Re: GTT
Posté par bubar🦥 . En réponse au lien [Clubic] Six semaines sans cloud : j'ai confié tout mon travail à une IA locale à 4 500 €. Évalué à 7 (+4/-0). Dernière modification le 19 juillet 2026 à 17:04.
Dans les grandes lignes :
Le sucre autour, c'est Newell qui s'en charge. Et bien qu'il apporte un overhead si on compare à LMstudio, ce dernier
(削除) pue fort (削除ここまで)n'est pas libre et d'autre part je suis un fervent supporter de Newell du début et tjs à ce jour :-)Pour la conf :
llama-server v9748 (livré par l'équipe Newell)
gemma-4-e4b.gguf
RAG actif / accès à certains dossiers de mes documents
Reconnaissance vocale :
Synthèse vocale :
Utilitaire d'affichage gpu :
En espérant avoir répondu à tes questions :)