Toute la question c'est "a quel point ils généralisent en dehors de ce qu'ils peuvent avoir lu dans leur apprentissage".
Le truc c'est qu'ils ont un très gros corpus et qu'ils ont lu beaucoup de code, plein d'exemples, bien plus que toi. D'où leur puissance en tant que "perroquet stockastique". Quand bien même ils ne feraient que reproduire des choses déjà vues, approximativement, ils en ont vu bien plus que n'importe quel humain. Et avec une grosse profondeur de contexte, de nos jours. Ça suffit pour faire illusion sur pleins de trucs, en donnant l'impression qu'ils ont des capacités qu'ils n'ont pas (c'est indépendant de la suite)
La question après ça c'est : qu'est ce qui est nécessaire pour faire une bonne "illusion". Est ce que leur reconnaissance de motif est assez abstraite pour qu'ils apprennent des règles de déduction logique et les appliquent correctement ? Dans une certaine mesure. Mais ... Est ce que ça suffit pour produire des résultats vraiment nouveaux ? Pour de la deduction logique pure, les maths sont un champ d'expérimentation intéressant pour ça évidemment parce qu'on a une bonne idée de ce qu'est un raisonnement correct, avec un peu de recul sur les versions précédentes on se rend compte que quand on essaye de mettre de la profondeur, sur des exos qu'un prof de math pourrait donner à ses élèves a différents niveau, ils reproduisaient plus la forme d'un raisonnement, avec des choses correctes, des choses fausses, des conclusions correctes mais qui ne correspondaient pas au raisonnement : ce n'est pas parce qu'ils produisent des choses qui marchent éventuellement qu'ils ont des capacités "surhumaines". On ne sait pas forcément "comment" ils font quand ils sortent un résultat correct.
Il y a plein d'obstacles à ça qui doivent faire qu'on garde un euil critique. Par exemple pour un raisonnement mathématique ou jouer aux échecs tu peux comparer au fonctionnement des algos qui le font de manière exacte : ils explorent souvent un arbre des possible en maintenant soigneusement la correction a chaque étape. Ça peut faire plein de branches, ça explose en combinatoire. Comment ferait chatgpt pour maintenir un tel arbre des possibles avec son contexte relativement limité et sa tendance à se tromper n'importe où (ce qui rend douteux toute la suite) sans savoir pour déduire des trucs vraiment originaux et très loin de ce qu'il a appris comme résultat ?
Sur le sens commun, il ne "connait" le monde qu'au travers de texte et éventuellement un peu d'images, on est loin d'une expérience humaine complete.
Ne serait-ce que sur ces points ... Il est relativement compliqué, pour des trucs qui ont la prétention d'être génériques, de les tester sur tous les domaines,vet de les tester tout court. Ça contraste évidemment sérieusement avec les affirmations marketing sans nuances 'vous avez un expert niveau doctorat dans votre poche dans tous les domaines qui sont évidemment de l'ordre du risible tellement c'est juste du wishful thinking affirmé sans aucune preuve sur la base de 'j'ai test bro crois moi j'ai senti une étincelle, avec tous ces cylindres tu sens la puissance des vibrations au volant'.
[^] # Re: Le choix de ~Sophie~ Claude
Posté par thoasm . En réponse au lien Extorsion automatisée, chantage ciblé... quand Claude Code pilote une opération de « vibe hacking » . Évalué à 9.
Toute la question c'est "a quel point ils généralisent en dehors de ce qu'ils peuvent avoir lu dans leur apprentissage".
Le truc c'est qu'ils ont un très gros corpus et qu'ils ont lu beaucoup de code, plein d'exemples, bien plus que toi. D'où leur puissance en tant que "perroquet stockastique". Quand bien même ils ne feraient que reproduire des choses déjà vues, approximativement, ils en ont vu bien plus que n'importe quel humain. Et avec une grosse profondeur de contexte, de nos jours. Ça suffit pour faire illusion sur pleins de trucs, en donnant l'impression qu'ils ont des capacités qu'ils n'ont pas (c'est indépendant de la suite)
La question après ça c'est : qu'est ce qui est nécessaire pour faire une bonne "illusion". Est ce que leur reconnaissance de motif est assez abstraite pour qu'ils apprennent des règles de déduction logique et les appliquent correctement ? Dans une certaine mesure. Mais ... Est ce que ça suffit pour produire des résultats vraiment nouveaux ? Pour de la deduction logique pure, les maths sont un champ d'expérimentation intéressant pour ça évidemment parce qu'on a une bonne idée de ce qu'est un raisonnement correct, avec un peu de recul sur les versions précédentes on se rend compte que quand on essaye de mettre de la profondeur, sur des exos qu'un prof de math pourrait donner à ses élèves a différents niveau, ils reproduisaient plus la forme d'un raisonnement, avec des choses correctes, des choses fausses, des conclusions correctes mais qui ne correspondaient pas au raisonnement : ce n'est pas parce qu'ils produisent des choses qui marchent éventuellement qu'ils ont des capacités "surhumaines". On ne sait pas forcément "comment" ils font quand ils sortent un résultat correct.
Il y a plein d'obstacles à ça qui doivent faire qu'on garde un euil critique. Par exemple pour un raisonnement mathématique ou jouer aux échecs tu peux comparer au fonctionnement des algos qui le font de manière exacte : ils explorent souvent un arbre des possible en maintenant soigneusement la correction a chaque étape. Ça peut faire plein de branches, ça explose en combinatoire. Comment ferait chatgpt pour maintenir un tel arbre des possibles avec son contexte relativement limité et sa tendance à se tromper n'importe où (ce qui rend douteux toute la suite) sans savoir pour déduire des trucs vraiment originaux et très loin de ce qu'il a appris comme résultat ?
Sur le sens commun, il ne "connait" le monde qu'au travers de texte et éventuellement un peu d'images, on est loin d'une expérience humaine complete.
Ne serait-ce que sur ces points ... Il est relativement compliqué, pour des trucs qui ont la prétention d'être génériques, de les tester sur tous les domaines,vet de les tester tout court. Ça contraste évidemment sérieusement avec les affirmations marketing sans nuances 'vous avez un expert niveau doctorat dans votre poche dans tous les domaines qui sont évidemment de l'ordre du risible tellement c'est juste du wishful thinking affirmé sans aucune preuve sur la base de 'j'ai test bro crois moi j'ai senti une étincelle, avec tous ces cylindres tu sens la puissance des vibrations au volant'.