• [^] # Re: Le sens des priorités

    Posté par (site web personnel) . En réponse au lien UE : l'IA doit s'afficher. Évalué à 6 (+4/-0).

    Et sur la question du filtrage, c'est aussi un souci complexe. Pour donner un exemple, comment tu gères si un modèle doit analyser les thèmes de Lolita, ou qu'on demande à traduire le roman en luxembourgeois ? Et des cas de filtrage automatique pourri, il y a eu des exemples connus (par exemple celui du père qui a été banni de Google pour avoir envoyer des photos à la demande de son docteur en 2022).

    Il y a une différence entre ce qu'il y a dans les machines et ce que les utilisateurs peuvent amener. Les entreprises qui ont fait le choix d'inclure dans des données d'entrainement des textes/images érotiques,pornographiques voir pédoporn ont une responsabilité. Je ne crois pas que Lolita soit obligatoire à inclure dans le corpus pour qu'un LLM apprenne à faire des phrases qui sont syntaxiquement correcte. Certes, ça aurait demandé de ne pas inclure toute la littérature de "romance" mais il y aurait encore eu assez de données pour apprendre à parler aux LLM. Ça aurait aussi demandé d'inclure bien moins d'images de filles légèrement vêtus et ça aurait sans doute été un mieux pour la variation dans les générations d'images par la suite. Ensuite, dans le cadre d'analyse/traductions d'œuvres litigieuses (comme Lolita), je doute que ça aurait eu beaucoup d'impact. À l'origine, Deepl avait été entrainé uniquement avec des textes traduits de façon certifiée (un corpus plutôt limité !), et ça ne l'empêchait d'arriver à traduire des textes avec des fautes, sur les sujets les plus variés.

    Les base de données des LLM ont été créés dans un cadre puritain (américains et chinois principalement ; les deux cultures ne sont pas des plus à l'aise avec la sexualité, qu'elle soit positive ou non). Il y a dans ces cultures tout un discours moral plutôt tranché (auquel on adhère ou non, mais il est là), où l'épouvantail du pedoporn est régulièrement brandi pour des prétextes variés, servant généralement à faire reculer des droits fondamentaux et à opprimer, plus qu'à réellement protéger les victimes. J'aurais attendu un peu plus de cohérence côté politique. Et il y a quand même une différence sans appel entre la façon dont certaines grosses entreprises ont mis très vite tous les gardes-fous qu'elles pouvaient et celles qui se sont vautrés dans le stupre sans remord. Faire générer une phrase vaguement sexuelle à ChatGPT a toujours tenu du jailbreak ; éviter du porn grossier et non consensuel avec Character.ai tenait du jailbreak dans le même temps. Le second ciblant très clairement les ados dans son marketting, et ayant des modèles visiblement entrainé sur des chat porn, à quel moment on arrête de donner des excuses ?

    Je précise bien que ce qui m'horripile est l'hypocrisie politique plus que tout le reste. Ouais, bon, je trouve très moche que des gamins soient exposés à des choses crasses, mais ça c'est une opinion un peu facile (qui va défendre le contraire ?). Mais là on a des politiques, des gens qui ont le pouvoir d'agir, qui disent "écoutez, ça fait rentrer des sous, alors on ne va pas arrêter tout de suite ces gens ; on va plutôt commencer par frapper là où il n'y a pas d'impact économique. Mais oui, oulala, c'est grave hein ! Un jour, un jour, vous verrez, on va taper des poings sur la table et dire qu'on est pas content ! Par contre, déportez moi ces immigrés en camp de concentration, ils ne rapportent pas de sous."

    Je ne suis pas surprise, mais ça m'agace mortellement. Et je ferais mieux de faire un peu de méditation, parce que ça n'a rien de nouveau que les politiques soient des tartuffes qui nous prennent pour des crétins et que ça ne va pas s'arrêter parce que je partage mon humeur ici ;)

    Je te rejoins par ailleurs sur le souci de la modération automatique, cette fois sur le contenu amené par les utilisateurs. Là on a forcément des dérives et soucis, largement documentés, ce qui est encore un autre problème à mes yeux. Or, on voit se monter un arsenal qui va frapper plus fort sur les gens comme ce père de famille, tout en laissant les vrais nuisibles (comme Grok) continuer sans grosses conséquences. Mais pour le coup, je ne suis pas certaine que cet AI Act vise cela ? Cela semble plutôt se concentrer sur ce que les entreprises laissent générer/exploitent comme données.