• [^] # Re: GTT

    Posté par . En réponse au lien [Clubic] Six semaines sans cloud : j'ai confié tout mon travail à une IA locale à 4 500 €. Évalué à 7 (+4/-0). Dernière modification le 19 juillet 2026 à 17:04.

    Dans les grandes lignes :
    Le sucre autour, c'est Newell qui s'en charge. Et bien qu'il apporte un overhead si on compare à LMstudio, ce dernier (削除) pue fort (削除ここまで) n'est pas libre et d'autre part je suis un fervent supporter de Newell du début et tjs à ce jour :-)

    Pour la conf :

    • llama-server v9748 (livré par l'équipe Newell)

      • reasoning-format désactivé
      • reasoning-budget désactivé
      • semantic-memory activée
    • gemma-4-e4b.gguf

      • température à 0
      • Pénalité de fréquence à 2
      • Native tools calling
      • désactivation du TextStreamer pour éviter le "think leak" sans désactiver le "think"
      • Mmproj activé pour la reconnaissance d'image
      • accélération matérielle activée
    • RAG actif / accès à certains dossiers de mes documents

    Reconnaissance vocale :

    • Whisper C++ (ggml-small-bin)
      • model small
      • VAD activé (silence à 1 / speech-duration à 5)
      • accélération matérielle activée

    Synthèse vocale :

    • Kokoro (82m / voice v1)

    Utilitaire d'affichage gpu :

    • radeontool

    En espérant avoir répondu à tes questions :)