Pourquoi se focaliser sur une couche au milieu du réseau de neurone plutôt que sur la dernière couche, celle qui donne le score, et calculer le gradient par rapport à celle là ? Eh bien je ne sais pas, je suis d'accord avec toi que ça semble être la meilleure idée pour l'apprentissage non-guidé. Malheureusement le programme plante quand je lui donne 'prob' comme nom de couche à optimizer (la derniere couche)
[^] # Re: le code?
Posté par Troy McClure (site web personnel) . En réponse au journal Deep NSFW dreams. Évalué à 2. Dernière modification le 03 octobre 2016 à 15:40.
Pourquoi se focaliser sur une couche au milieu du réseau de neurone plutôt que sur la dernière couche, celle qui donne le score, et calculer le gradient par rapport à celle là ? Eh bien je ne sais pas, je suis d'accord avec toi que ça semble être la meilleure idée pour l'apprentissage non-guidé. Malheureusement le programme plante quand je lui donne 'prob' comme nom de couche à optimizer (la derniere couche)