Voilà, ça n'aura pas traîné, on a déjà les premiers papiers de recherche qui montre comment ces modèles sont capable de recracher des quasi-copies des images sur lesquelles ils se sont entraînés. Ouvrez le PDF du lien, il des images d'exemple, avec Stable Diffusion qui a recrache des images quasiment à l'identique (hormis la grosse perte de qualité) avec le prompt adéquat.
Bon c'est un petit lien pour ceux qui sur LinuxFr ne comprennent pas comment ces systèmes entraîné sur des données réelles fonctionnent et sortent encore régulièrement qu'ils ne voient aucun risque de droit d'auteur, que ces images sont bel et bien des "créations" du modèle et autres absurdités. Genre on lit des trucs ridicules genre que ça ne reproduit que le "style" et que le style n'est pas sous droit d'auteur (mais c'est quoi "le style"? Et surtout plus précisément pour un modèle d'apprentissage, ça veut dire quoi le style? Cherchez pas, ça n'existe pas; sortir ce type d'argument ne veut rien dire). Encore une fois, sûrement parce que vous vous faites avoir par l'idée que ces logiciels sont "intelligents". Non ils ne le sont pas. Ces systèmes logiciels "n'apprennent" pas réellement, ils ne comprennent pas ce qu'ils font (ou ce que vous leur dites quand vous envoyez une commande, même si c'est en langage naturel donc vous avez l'impression qu'il y a une intéraction de compréhension mutuelle. Non.), ils ne reproduisent pas des styles ou des genres (même si vous leur avez dit de le faire et qu'on a l'impression qu'ils le font puisque le rendu est dans le style approprié; ça a juste recraché les bonnes données qui étaient "tagguées" de manière appropriée, en simplifiant en très gros), ils ne dessinent pas, ils ne réfléchissent pas sur un sujet que vous leur suggérez...
Y a eu plusieurs commentaires dans ce sens sur LinuxFr par ceux qui veulent absolument défendre ces systèmes d'IA (pour une raison que j'ai du mal à comprendre) et à chaque fois, je me retenais de répondre. Alors c'est bien qu'y ait maintenant des papiers de recherche sur le sujet qui commencent à sortir! 😁
# Pour ceux qui ressortent encore régulièrement que ces "AI" "créent" des images...
Posté par Jehan (site web personnel, Mastodon) . En réponse au lien "Extracting Training Data from Diffusion Models" - Stable Diffusion (et autres "AI") et copyright. Évalué à 10.
Voilà, ça n'aura pas traîné, on a déjà les premiers papiers de recherche qui montre comment ces modèles sont capable de recracher des quasi-copies des images sur lesquelles ils se sont entraînés. Ouvrez le PDF du lien, il des images d'exemple, avec Stable Diffusion qui a recrache des images quasiment à l'identique (hormis la grosse perte de qualité) avec le prompt adéquat.
Bon c'est un petit lien pour ceux qui sur LinuxFr ne comprennent pas comment ces systèmes entraîné sur des données réelles fonctionnent et sortent encore régulièrement qu'ils ne voient aucun risque de droit d'auteur, que ces images sont bel et bien des "créations" du modèle et autres absurdités. Genre on lit des trucs ridicules genre que ça ne reproduit que le "style" et que le style n'est pas sous droit d'auteur (mais c'est quoi "le style"? Et surtout plus précisément pour un modèle d'apprentissage, ça veut dire quoi le style? Cherchez pas, ça n'existe pas; sortir ce type d'argument ne veut rien dire). Encore une fois, sûrement parce que vous vous faites avoir par l'idée que ces logiciels sont "intelligents". Non ils ne le sont pas. Ces systèmes logiciels "n'apprennent" pas réellement, ils ne comprennent pas ce qu'ils font (ou ce que vous leur dites quand vous envoyez une commande, même si c'est en langage naturel donc vous avez l'impression qu'il y a une intéraction de compréhension mutuelle. Non.), ils ne reproduisent pas des styles ou des genres (même si vous leur avez dit de le faire et qu'on a l'impression qu'ils le font puisque le rendu est dans le style approprié; ça a juste recraché les bonnes données qui étaient "tagguées" de manière appropriée, en simplifiant en très gros), ils ne dessinent pas, ils ne réfléchissent pas sur un sujet que vous leur suggérez...
Y a eu plusieurs commentaires dans ce sens sur LinuxFr par ceux qui veulent absolument défendre ces systèmes d'IA (pour une raison que j'ai du mal à comprendre) et à chaque fois, je me retenais de répondre. Alors c'est bien qu'y ait maintenant des papiers de recherche sur le sujet qui commencent à sortir! 😁
Voir aussi ce tweet pour ceux qui préfèrent ce format: https://twitter.com/Eric_Wallace_/status/1620449934863642624
Film d'animation libre en CC by-sa/Art Libre, fait avec GIMP et autre logiciels libres: ZeMarmot [ http://film.zemarmot.net ]