Ils ne peuvent le faire qu'en répétant que quelqu'un l'a déjà dit
Les LLM (en particulier les modèles dit "frontières") aujourd'hui sont capables de déductions. Ils peuvent te donner une probabilité de fiabilité de réponse. Ils peuvent identifier des situations où « je ne sais pas » est la réponse correcte, sans avoir rencontré exactement cette situation auparavant (et donc sans avoir lu la réponse ailleurs si c'est ce que tu voulais dire). Tu fournis un document en demandant des informations qui ne s'y trouvent pas, ils peuvent répondre "le contexte ne me permet pas de répondre". Avec les modèles à "raisonnement" on a quitté le step "générateur de texte" depuis un moment. Il faut aussi voir qu'on est rarement exposé directement au modèle. Il y a toute une couche autour (le fameux "harnais") avec le prompt système, du routage, des sous-agents, des règles... Mais le problème de l'abstention des LLM n'est bien sûr pas résolu (sinon ça voudrait dire que les hallucinations n'existent plus et ça n'est pas le cas). La recherche se poursuit. Exemple
Le problème récurrent est surtout de prétendre connaître les LLMs du simple fait de les utiliser
Je n'ai pas l'impression d'avoir fait ça. Ni de l'avoir vu ici d'ailleurs. Mais je peux par contre confirmer que les LLM aujourd'hui sont capables de ne pas répondre (donc dire "je ne sais pas") si c'est la réponse adéquate.
[^] # Re: Nouvelles failles ou pas
Posté par Faya . En réponse au journal L'efficacité des LLMs pour la recherche de vulnérabilités, point de vue d'un mainteneur. Évalué à 2 (+0/-0).
Les LLM (en particulier les modèles dit "frontières") aujourd'hui sont capables de déductions. Ils peuvent te donner une probabilité de fiabilité de réponse. Ils peuvent identifier des situations où « je ne sais pas » est la réponse correcte, sans avoir rencontré exactement cette situation auparavant (et donc sans avoir lu la réponse ailleurs si c'est ce que tu voulais dire). Tu fournis un document en demandant des informations qui ne s'y trouvent pas, ils peuvent répondre "le contexte ne me permet pas de répondre". Avec les modèles à "raisonnement" on a quitté le step "générateur de texte" depuis un moment. Il faut aussi voir qu'on est rarement exposé directement au modèle. Il y a toute une couche autour (le fameux "harnais") avec le prompt système, du routage, des sous-agents, des règles... Mais le problème de l'abstention des LLM n'est bien sûr pas résolu (sinon ça voudrait dire que les hallucinations n'existent plus et ça n'est pas le cas). La recherche se poursuit. Exemple
Je n'ai pas l'impression d'avoir fait ça. Ni de l'avoir vu ici d'ailleurs. Mais je peux par contre confirmer que les LLM aujourd'hui sont capables de ne pas répondre (donc dire "je ne sais pas") si c'est la réponse adéquate.