le jour où on me dira que des LLMs acceptent de répondre "je ne sais pas".
Disons qu'ils y a beaucoup de travaux dans ce sens (déso j'ai pas de lien précis, entendu des podcasts et vu des vidéos qui parlaient de ça).
En fait, si tu prends un LLM "seul" (à nu on pourrait dire), ils fonctionnent toujours comme tu dis, mais maintenant quand tu questionnes Gemini, Claude etc. En fait, tu ne questionnes pas juste un LLM. Tu questionnes un système qui a des outils à sa disposition, qui a des mécanismes de "réflexion" (dans le sens où une partie de sa sortie n'est pas affichée par défaut) qui vont lui permettre de nuancer ses propos et parfois de pouvoir dire qu'il ne sait pas.
Anthropic et d'autres essaient aussi d'avoir des mécanisme d'analyse des "patterns d'activation neuronale" qui s'activent quand le LLM "invente" ou ne fait pas appelle au zone de son réseau qui constitue sa base de connaissance, afin de pouvoir "détecter" quand un LLM ne sait pas et donc intervenir en amont de la réponse finale, mais je crois que ce genre de piste est encore exploratoire.
[^] # Re: Nouvelles failles ou pas
Posté par Andréas Livet . En réponse au journal L'efficacité des LLMs pour la recherche de vulnérabilités, point de vue d'un mainteneur. Évalué à 2 (+0/-0).
Disons qu'ils y a beaucoup de travaux dans ce sens (déso j'ai pas de lien précis, entendu des podcasts et vu des vidéos qui parlaient de ça).
En fait, si tu prends un LLM "seul" (à nu on pourrait dire), ils fonctionnent toujours comme tu dis, mais maintenant quand tu questionnes Gemini, Claude etc. En fait, tu ne questionnes pas juste un LLM. Tu questionnes un système qui a des outils à sa disposition, qui a des mécanismes de "réflexion" (dans le sens où une partie de sa sortie n'est pas affichée par défaut) qui vont lui permettre de nuancer ses propos et parfois de pouvoir dire qu'il ne sait pas.
Anthropic et d'autres essaient aussi d'avoir des mécanisme d'analyse des "patterns d'activation neuronale" qui s'activent quand le LLM "invente" ou ne fait pas appelle au zone de son réseau qui constitue sa base de connaissance, afin de pouvoir "détecter" quand un LLM ne sait pas et donc intervenir en amont de la réponse finale, mais je crois que ce genre de piste est encore exploratoire.