Mais indiquer que le contenu est généré par IA est aussi plus facile à faire que de filtrer le contenu produit sur des critères qui sont quand même flous. Google a sa technologie SynthID, mais c'est plus facile de mettre un filigrane dans les images que dans le texte ou c'est encore un domaine de recherche actif qui a commencé il n'y a pas si longtemps que ça. Le papier que tout le monde semble citer sur le sujet, A Watermark for Large Language Models, date de mai 2024, le papier de SynthID a été publié un peu plus tard en octobre 2024.
Et sur la question du filtrage, c'est aussi un souci complexe. Pour donner un exemple, comment tu gères si un modèle doit analyser les thèmes de Lolita, ou qu'on demande à traduire le roman en luxembourgeois ? Et des cas de filtrage automatique pourri, il y a eu des exemples connus (par exemple celui du père qui a été banni de Google pour avoir envoyer des photos à la demande de son docteur en 2022).
De plus, même sans les obligations de l'AI Act, il y a déjà eu des réactions et des obligations comme on l'a vu avec Grok en début d'année une fois que ç'est devenu viral (parce que oui, les premiers articles sur Grok qui déshabille les femmes, c'était 6 mois avant). Alors bien sur, visiblement, xAI ne fait pas suffisamment d'effort vu qu'on continue à trouver des deepfakes, mais les utilisateurs cherchent aussi à activement contourner les protections, il y a des sous reddit entiers dédiés.
[^] # Re: Le sens des priorités
Posté par Misc (site web personnel) . En réponse au lien UE : l'IA doit s'afficher. Évalué à 3 (+0/-0).
Mais indiquer que le contenu est généré par IA est aussi plus facile à faire que de filtrer le contenu produit sur des critères qui sont quand même flous. Google a sa technologie SynthID, mais c'est plus facile de mettre un filigrane dans les images que dans le texte ou c'est encore un domaine de recherche actif qui a commencé il n'y a pas si longtemps que ça. Le papier que tout le monde semble citer sur le sujet, A Watermark for Large Language Models, date de mai 2024, le papier de SynthID a été publié un peu plus tard en octobre 2024.
Et sur la question du filtrage, c'est aussi un souci complexe. Pour donner un exemple, comment tu gères si un modèle doit analyser les thèmes de Lolita, ou qu'on demande à traduire le roman en luxembourgeois ? Et des cas de filtrage automatique pourri, il y a eu des exemples connus (par exemple celui du père qui a été banni de Google pour avoir envoyer des photos à la demande de son docteur en 2022).
De plus, même sans les obligations de l'AI Act, il y a déjà eu des réactions et des obligations comme on l'a vu avec Grok en début d'année une fois que ç'est devenu viral (parce que oui, les premiers articles sur Grok qui déshabille les femmes, c'était 6 mois avant). Alors bien sur, visiblement, xAI ne fait pas suffisamment d'effort vu qu'on continue à trouver des deepfakes, mais les utilisateurs cherchent aussi à activement contourner les protections, il y a des sous reddit entiers dédiés.