• [^] # Re: sommes nous davantage que des synthétiseurs textuels ?

    Posté par . En réponse au journal Le vocable « intelligence artificielle » vs synthétiseur de texte ?. Évalué à 1.

    Pourquoi dis-tu qu'il ne sait pas que 1 + 1 = 2 ? Comme dit plus haut, il gère très bien les additions. Si tu ne veux pas créer de compte, tu peux tester HuggingChat : je ne l'ai pas beaucoup testé, il a l'air moins bon en maths que ChatGPT (il se plante sur les grosses additions), mais il sait très bien combien font 1 + 1.

    en dessous de quelle difficulté ne se trompe-t'il jamais ?

    Aucun ordinateur ne fait jamais d'erreur, il peut toujours y avoir un rayon cosmique qui traîne et qui induit un bug non rattrapé par la détection/correction d'erreur. Ce niveau d'exigence est absurde et inutile. La bonne question serait de savoir quel est le risque d'erreur acceptable. Il est ensuite simple de faire des jeux d'essais pour estimer le taux d'erreurs du modèle de langage sur le type de problème qui nous intéresse, et de décider si c'est acceptable ou pas.

    Empiriquement, je constate que, dans les calculs formels, le risque d'erreur de ChatGPT augmente avec le nombre d'étapes de raisonnement. On peut y trouver une explication : dans un raisonnement formel, la bonne étape de raisonnement est celle qui est la plus probable dans le modèle de langage. Mais ces outils ne nous donnent pas l'étape la plus probable, ils tirent au hasard une étape proportionnellement à leur probabilité. Cela peut se corriger en donnant au modèle de langage une quantité si importante de raisonnements formels que la probabilité de donner autre chose que l'étape la plus probable va tendre vers zéro. En plus, générer automatiquement des tonnes de raisonnements formels est facile.