• [^] # Re: Il faudrait faire interdire l'alpha-beta

    Posté par (Mastodon) . En réponse à la dépêche Deep Fritz et Vladimir Kramnik ex-aequo. Évalué à 1.

    À priori on sait faire des fonctions d'évaluation (celles utilisées dans le minmax) qui évoluent en fonction des résultats. Si une position évaluée bonne se révèle désastreuse, la fonction s'ajuste. En ce sens les logiciels apprennent quelque chose en jouant. Mais c'est toujours de la force brute au final.

    Par contre, je ne sais pas pour les échecs, mais pour le Go on a des logiciels basés sur des réseaux de neurones, qui apprennent en jouant, mais qui jouent mal, comme les autres ;-)