Et pour le Go, les joueurs humainssavent à nouveau vaincre les ordinateurs, il suffit de jouer des coups évidents qu'un joueur humain contrerait immédiatement, et qui n'apparaissent t donc jamais dans les jeux de données sur lesquels l'ordinateur a été entraìné. Ce qui fait qu'il ne sait pas les bloquer.
Tu as une source pour ça? Ça n'est pas du tout comme ça que fonctionne alphaGo (il s'améliore contre lui-même, il n'apprend pas du tout à partir d'une base de données). A priori, ce mode de fonctionnement le protège complètement de ce genre de martingales.
ce qui a conduit kasparov à croire qu'il avait raté un truc.
C'est la version de Kasparov, mondialement connu pour être bon perdant. Comme depuis aucun champion d'échec n'a jamais battu un ordinateur, et que les ordis d'aujourd'hui mettent 1000 points ELO aux meilleurs humains, je pense qu'on peut conclure avec pas mal de certitude que Kasparov vs Deep Blue marque à quelques mois près le moment où les ordinateurs sont devenus pour toujours meilleurs que les humains aux échecs.
La capacité à faire des calculs mathématiques fiables, à ne pas inventer des références qui n'existent pas, etc, ce n'est simplement pas possible avec cette technologie.
L'histoire des références qui n'existent pas me semble très largement résolue dans les dernières versions de ChatGPT, apparemment, c'est quelque chose qui peut être paramétré (peut-être dans l'invocation du bot). Pour les maths, c'est théoriquement impossible qu'un modèle de langage soit mathématiquement fiable (dans le sens d'un assistant de preuve, ou quelque chose dans le genre). Par contre, si tu entraines ChatGPT sur des milliards et des milliards de sorties de Wolfram au lieu de l'entrainer sur facebook et Twitter, je pense qu'il va réussir à résoudre pas mal d'équations différentielles...
En fait, ça semble de plus en plus dur de piéger chatGPT avec des problèmes mathématiques ambigus (du style "combien de mois faut-il à 9 femmes pour faire un bébé"). C'est évidemment possible, mais il faut trouver des problèmes qu'il ne connait pas, parce que quand il connait, il répond de manière très convainquante:
"Bonjour! La durée nécessaire pour faire un bébé ne change pas en fonction du nombre de femmes impliquées. Chaque grossesse individuelle prend généralement environ 9 mois, quel que soit le nombre de personnes concernées. Le processus biologique de la grossesse suit son cours indépendamment du nombre de femmes impliquées. Ainsi, même si 9 femmes sont impliquées, chacune d'entre elles aura toujours besoin de 9 mois pour mener à bien une grossesse."
Je viens de faire un essai, ChatGPT a 4/5 sur des problèmes de maths de CM2, par exemple. Il a fait une erreur d'un facteur 10 sur une multiplication, c'est étonamment humain comme erreur! Mais bon, il n'est pas "nul" en maths, il a probablement un niveau équivalent à un humain moyen. J'ai fait un essai il y a quelques mois avec ma femme qui est enseignante, ChatGPT aurait largement le bac avec mention. Peut-être pas terrible en maths, mais excellent en français, philo, histoire-géo, et SVT. Il faut bien comprendre que quand on dit qu'il n'est pas au niveau des humains, il n'est pas au niveau des meilleurs humains: il ne peut pas rendre un travail universitaire créatif, il ne peut pas écrire un bon roman, il ne peut pas composer une fugue intéressante, etc. Mais moi non plus je ne peux pas composer une fugue!
Ceci dit, vu son mode de fonctionnement, c'est difficile d'imaginer comment il pourrait être meilleur que les meilleurs humains à une tâche spécifique. Il peut par contre probablement être un peu en dessous des meilleurs humains pour tout un tas d'activités, ce qui est quand même assez remarquable.
[^] # Re: Pour combien de temps ?
Posté par arnaudus . En réponse au lien À ce jour, toutes les intelligences artificielles butent sur les maths . Évalué à 9.
Tu as une source pour ça? Ça n'est pas du tout comme ça que fonctionne alphaGo (il s'améliore contre lui-même, il n'apprend pas du tout à partir d'une base de données). A priori, ce mode de fonctionnement le protège complètement de ce genre de martingales.
C'est la version de Kasparov, mondialement connu pour être bon perdant. Comme depuis aucun champion d'échec n'a jamais battu un ordinateur, et que les ordis d'aujourd'hui mettent 1000 points ELO aux meilleurs humains, je pense qu'on peut conclure avec pas mal de certitude que Kasparov vs Deep Blue marque à quelques mois près le moment où les ordinateurs sont devenus pour toujours meilleurs que les humains aux échecs.
L'histoire des références qui n'existent pas me semble très largement résolue dans les dernières versions de ChatGPT, apparemment, c'est quelque chose qui peut être paramétré (peut-être dans l'invocation du bot). Pour les maths, c'est théoriquement impossible qu'un modèle de langage soit mathématiquement fiable (dans le sens d'un assistant de preuve, ou quelque chose dans le genre). Par contre, si tu entraines ChatGPT sur des milliards et des milliards de sorties de Wolfram au lieu de l'entrainer sur facebook et Twitter, je pense qu'il va réussir à résoudre pas mal d'équations différentielles...
En fait, ça semble de plus en plus dur de piéger chatGPT avec des problèmes mathématiques ambigus (du style "combien de mois faut-il à 9 femmes pour faire un bébé"). C'est évidemment possible, mais il faut trouver des problèmes qu'il ne connait pas, parce que quand il connait, il répond de manière très convainquante:
"Bonjour! La durée nécessaire pour faire un bébé ne change pas en fonction du nombre de femmes impliquées. Chaque grossesse individuelle prend généralement environ 9 mois, quel que soit le nombre de personnes concernées. Le processus biologique de la grossesse suit son cours indépendamment du nombre de femmes impliquées. Ainsi, même si 9 femmes sont impliquées, chacune d'entre elles aura toujours besoin de 9 mois pour mener à bien une grossesse."
Je viens de faire un essai, ChatGPT a 4/5 sur des problèmes de maths de CM2, par exemple. Il a fait une erreur d'un facteur 10 sur une multiplication, c'est étonamment humain comme erreur! Mais bon, il n'est pas "nul" en maths, il a probablement un niveau équivalent à un humain moyen. J'ai fait un essai il y a quelques mois avec ma femme qui est enseignante, ChatGPT aurait largement le bac avec mention. Peut-être pas terrible en maths, mais excellent en français, philo, histoire-géo, et SVT. Il faut bien comprendre que quand on dit qu'il n'est pas au niveau des humains, il n'est pas au niveau des meilleurs humains: il ne peut pas rendre un travail universitaire créatif, il ne peut pas écrire un bon roman, il ne peut pas composer une fugue intéressante, etc. Mais moi non plus je ne peux pas composer une fugue!
Ceci dit, vu son mode de fonctionnement, c'est difficile d'imaginer comment il pourrait être meilleur que les meilleurs humains à une tâche spécifique. Il peut par contre probablement être un peu en dessous des meilleurs humains pour tout un tas d'activités, ce qui est quand même assez remarquable.