Ouah merci pour la citation de mon petit gégé ! D'autant plus que si il existe c'est - entre autre - grâce à ta série de journaux qui m'ont vraiment mis le pied à l'étrier des LLM auto-hébergés. (d'ailleurs au passage suggestion de prochain journal : les différents paramètres des LLM et leurs influence, par exemple si je vois mon LLM tourner en boucle, ou si il réfléchit trop, quels sont les paramètres en jeu etc.)
Alors l'idée de base c'était d'avoir un simple fichier python (par exemple tout simplement ia.py ou open_cli.py pour continuer dans les noms avec manque d'inspiration ;) ) et de se faire son propre alias. Appelle-le juju si tu préfères !
Au début c'était juste un proof of concept pour manipuler le LLM à la mano, mais finalement il s'étoffe de plus en plus, et est même maintenant agentique (via MCP). Du coup tu me donnes envie de le publier, toujours dans un objectif pédagogique. Embarquer l'outil 'date' par exemple est une bonne idée comme premier exemple. Ça et l'ouverture vers le MCP, tu as tous les outils pour faire ton propre agent.
Parce que perso, maintenant que je vois clairement comment ça marche, c'est évident que quand on voit un titre "une IA s'est barrée de son cloisonnement par attaquer tout Internet", désolé, mais c'est vraiment la faute de l'agent, pas de l'IA. Un LLM ça pisse du texte c'est tout. Ça n'exécute rien.
Quand j'ai cherché à implémenter les outils, j'avais fait 3 outils : read_file, write_file et shell command. Les 2 derniers étant jugés plus risqués, ils demandent l'autorisation de l'utilisateur. Et bien pendant mes essais pour vérifier que l'agent faisait bien son boulot d'agent, j'ai bien vu le LLM contourner les instructions pour tenter d'utiliser shell_command quand je lui refusais write_file alors que c'était explicitement interdit dans le prompt !
C'est jamais le prompt qui cloisonne le LLM, c'est l'agent, d'où l'idée de se coder son propre agent dès qu'on a un poil peur que ça parte en cacahuètes. Je compte m'en servir au boulot pour gérer une CI avec hardware in the loop, donc flashing, reboot etc... crois-moi que l'agent va être écrit sur-mesure !!!
En théorie, la théorie et la pratique c'est pareil. En pratique c'est pas vrai.
# Gégé award
Posté par gUI (Mastodon) . En réponse au journal Auto-héberger ses LLM (IA) : Interfaces utilisateur. Évalué à 4 (+1/-0).
Ouah merci pour la citation de mon petit gégé ! D'autant plus que si il existe c'est - entre autre - grâce à ta série de journaux qui m'ont vraiment mis le pied à l'étrier des LLM auto-hébergés. (d'ailleurs au passage suggestion de prochain journal : les différents paramètres des LLM et leurs influence, par exemple si je vois mon LLM tourner en boucle, ou si il réfléchit trop, quels sont les paramètres en jeu etc.)
Alors l'idée de base c'était d'avoir un simple fichier python (par exemple tout simplement
ia.pyouopen_cli.pypour continuer dans les noms avec manque d'inspiration ;) ) et de se faire son propre alias. Appelle-lejujusi tu préfères !Au début c'était juste un proof of concept pour manipuler le LLM à la mano, mais finalement il s'étoffe de plus en plus, et est même maintenant agentique (via MCP). Du coup tu me donnes envie de le publier, toujours dans un objectif pédagogique. Embarquer l'outil 'date' par exemple est une bonne idée comme premier exemple. Ça et l'ouverture vers le MCP, tu as tous les outils pour faire ton propre agent.
Parce que perso, maintenant que je vois clairement comment ça marche, c'est évident que quand on voit un titre "une IA s'est barrée de son cloisonnement par attaquer tout Internet", désolé, mais c'est vraiment la faute de l'agent, pas de l'IA. Un LLM ça pisse du texte c'est tout. Ça n'exécute rien.
Quand j'ai cherché à implémenter les outils, j'avais fait 3 outils :
read_file,write_fileetshell command. Les 2 derniers étant jugés plus risqués, ils demandent l'autorisation de l'utilisateur. Et bien pendant mes essais pour vérifier que l'agent faisait bien son boulot d'agent, j'ai bien vu le LLM contourner les instructions pour tenter d'utilisershell_commandquand je lui refusaiswrite_filealors que c'était explicitement interdit dans le prompt !C'est jamais le prompt qui cloisonne le LLM, c'est l'agent, d'où l'idée de se coder son propre agent dès qu'on a un poil peur que ça parte en cacahuètes. Je compte m'en servir au boulot pour gérer une CI avec hardware in the loop, donc flashing, reboot etc... crois-moi que l'agent va être écrit sur-mesure !!!
En théorie, la théorie et la pratique c'est pareil. En pratique c'est pas vrai.