Perso j'ai pas suivi en détail les évolutions des 20 dernières années, et c'est évident qu'il y en a eu. Mais cela reste juste des évolutions (pas des révolutions), ce qui est normal dans tout sujet en recherche active.
Il faudrait pourtant, si tu veux te faire une idée précise de ce qu’il se passe. Je vais juste prendre un exemple de ton message :
Par exemple, une étude sur les développeurs qui utilisaient des aides au développement par IA avait déterminé que non seulement ceux qui utilisaient ces aides produisaient un code moins sécurisé, mais qu'en plus ceux-ci croyaient qu'ils produisaient un code plus sécurisé
L’étude date de 2022 et utilise un modèle (Codex) de 2021. C’est avant la découverte des scaling laws modernes, quand on entraînait encore des modèles d’une manière extrêmement sous-optimale !
Les modèles d’aujourd’hui ?
o3 a un score Elo de 2700+ sur codeforces.
The median Codeforces rating is 1143. The mean rounded to the nearest integer is 1205. The standard deviation is 378 rounded down to the nearest integer.
A rating of 1900 places you at the 94th percentile.
A rating of 2400 places you at the 99.2nd percentile.
[^] # Re: Est-ce que je résume correctement ?
Posté par Moonz . En réponse au journal Quoi penser de l'IA dans mon monde de linuxien .... Évalué à 1.
Il faudrait pourtant, si tu veux te faire une idée précise de ce qu’il se passe. Je vais juste prendre un exemple de ton message :
L’étude date de 2022 et utilise un modèle (Codex) de 2021. C’est avant la découverte des scaling laws modernes, quand on entraînait encore des modèles d’une manière extrêmement sous-optimale !
Les modèles d’aujourd’hui ?
o3 a un score Elo de 2700+ sur codeforces.