ChaGPT mouline un peu plus entre ses fichiers d’entrée et de sortie, ce qui fait que tu as plus de mal en lisant sa sortie à retrouver les fragments des fichiers d’entrée qui l’ont produite, mais ça ne change pas grand chose à la question.
Bah si, ça change tout, puisque tu ne peux même pas prouver que la sortie dépend de ton œuvre qui est dans la base de données. La sortie de chatGPT n'est pas plus soumise au droit d'auteur que la sortie de md5sum. Comme je l'ai dit ailleurs, le droit d'auteur n'est pas diluable à l'infini.
Par exemple, ta phrase "Si tu prends le cas d’une IA un peu plus simple" est, selon toutes vraisemblance, soumise potentiellement au droit d'auteur. Il n'existe aucun hit sur Google, et il est vraisemblable que jamais personne avant toi ne l'avait écrite. Bien sûr, elle n'est pas d'une originalité incroyable, mais c'est ta phrase. Si ChatGPT te la ressort, tu peux avec une forme de certitude affirmer qu'il te l'a "volée". Ça marche aussi avec "Si tu prends le cas d'une IA"; apparemment personne n'avait non plus écrit ce bout de phrase. Par contre, "Si tu prends le cas d'une" ramène 15200 hits sur Google. De manière évidente, "Si tu prends le cas d'une" est un bout de phrase qui n'est pas à toi exclusivement. Si ChatGPT dit "Si tu prends le cas d'une", même si ta phrase à toi est dans sa base de données, tu ne peux pas en revendiquer l'exclusivité. Il est d'ailleurs probable que ce morceau de phrase est présent en plusieurs exemplaires, et que tu n'es pas le premier à l'avoir écrite.
Autrement dit, ce que j'essaye de dire, c'est qu'il existe une différence qualitative entre "Si tu prends le cas d'une", et "Si tu prends le cas d'une IA". Bien sûr, le droit d'auteur ne fonctionne pas exactement comme ça, mais il admet une différence qualitative entre ce qui est une œuvre de l'esprit et ce qui ne l'est pas. Il n'y a pas de "moitié d'œuvre", ou de violation partielle de droit d'auteur, c'est binaire.
Ce qui peut paraitre paradoxal, c'est que si tu entraines chatGPT avec du code sous GPL, la sortie n'est pas sous GPL, parce que la sortie n'est pas une œuvre dérivée, il n'y a pas eu assez de "copie" entre les milliers de sources et la sortie. De la même manière, tous les mots d'un texte peuvent être retrouvés dans l'œuvre de Zola, mais ça ne veut pas dire que tous les textes sont des plagiats de Zola.
[^] # Re: Assez consensuel
Posté par arnaudus . En réponse au journal Mon avis sur chatGPT. Évalué à 6.
Bah si, ça change tout, puisque tu ne peux même pas prouver que la sortie dépend de ton œuvre qui est dans la base de données. La sortie de chatGPT n'est pas plus soumise au droit d'auteur que la sortie de md5sum. Comme je l'ai dit ailleurs, le droit d'auteur n'est pas diluable à l'infini.
Par exemple, ta phrase "Si tu prends le cas d’une IA un peu plus simple" est, selon toutes vraisemblance, soumise potentiellement au droit d'auteur. Il n'existe aucun hit sur Google, et il est vraisemblable que jamais personne avant toi ne l'avait écrite. Bien sûr, elle n'est pas d'une originalité incroyable, mais c'est ta phrase. Si ChatGPT te la ressort, tu peux avec une forme de certitude affirmer qu'il te l'a "volée". Ça marche aussi avec "Si tu prends le cas d'une IA"; apparemment personne n'avait non plus écrit ce bout de phrase. Par contre, "Si tu prends le cas d'une" ramène 15200 hits sur Google. De manière évidente, "Si tu prends le cas d'une" est un bout de phrase qui n'est pas à toi exclusivement. Si ChatGPT dit "Si tu prends le cas d'une", même si ta phrase à toi est dans sa base de données, tu ne peux pas en revendiquer l'exclusivité. Il est d'ailleurs probable que ce morceau de phrase est présent en plusieurs exemplaires, et que tu n'es pas le premier à l'avoir écrite.
Autrement dit, ce que j'essaye de dire, c'est qu'il existe une différence qualitative entre "Si tu prends le cas d'une", et "Si tu prends le cas d'une IA". Bien sûr, le droit d'auteur ne fonctionne pas exactement comme ça, mais il admet une différence qualitative entre ce qui est une œuvre de l'esprit et ce qui ne l'est pas. Il n'y a pas de "moitié d'œuvre", ou de violation partielle de droit d'auteur, c'est binaire.
Ce qui peut paraitre paradoxal, c'est que si tu entraines chatGPT avec du code sous GPL, la sortie n'est pas sous GPL, parce que la sortie n'est pas une œuvre dérivée, il n'y a pas eu assez de "copie" entre les milliers de sources et la sortie. De la même manière, tous les mots d'un texte peuvent être retrouvés dans l'œuvre de Zola, mais ça ne veut pas dire que tous les textes sont des plagiats de Zola.