Je suis pas certain que ça joue dans leurs hypothèses, tout est caché dans "un moyen de choisir un échantillon dans la distribution", qui n'est absolument pas spécifié. Donc si je me trompe pas ça offre la possibilité de faire de l'apprentissage par renforcement, c'est à dire de choisir un peu les exemples en fonction de ses prédictions passées.
Mais je peux me tromper, ce qu'ils entendent par "un moyen" est assez flou, si ils le font pas c'est peut être justement comme ils le clament pour laisser vraiment les hypothèses les plus favorables. Mais je suis pas certain sur ce point et faudrait que je relise.
[^] # Re: (tentative de) résumé du papier
Posté par thoasm . En réponse au lien Team claims human-level AI is impossible — ever. Évalué à 3.
Je suis pas certain que ça joue dans leurs hypothèses, tout est caché dans "un moyen de choisir un échantillon dans la distribution", qui n'est absolument pas spécifié. Donc si je me trompe pas ça offre la possibilité de faire de l'apprentissage par renforcement, c'est à dire de choisir un peu les exemples en fonction de ses prédictions passées.
Mais je peux me tromper, ce qu'ils entendent par "un moyen" est assez flou, si ils le font pas c'est peut être justement comme ils le clament pour laisser vraiment les hypothèses les plus favorables. Mais je suis pas certain sur ce point et faudrait que je relise.