• [^] # Re: Quid du code?

    Posté par . En réponse au lien Proposition de loi relative à l'instauration d'une présomption d'exploitation des contenus culturels par les fournisseurs d'intelligence artificielle. Évalué à 4.

    À la sortie de ChatGPT pour le grand public on a pu constater plusieurs fois qu'il renvoyait du code identique à du code sous licence. Et bien il semble que ça soit toujours le cas :

    Using LiCoEval, we evaluate 14 popular LLMs, finding that even top-performing LLMs produce a non-negligible proportion (0.88% to 2.01%) of code strikingly similar to existing open-source implementations. Notably, most LLMs fail to provide accurate license information, particularly for code under copyleft licenses. These findings underscore the urgent need to enhance LLM compliance capabilities in code generation tasks.

    Mais avec les agents qui écrivent du code au kilomètre, ça me paraît compliqué à respecter... Est-ce qu'ils vont remplir les fichiers de commentaires pour citer les sources des morceaux de code ? Après la règle ne vaut que pour du code non-trivial. Je n'ai pas fouillé l'étude en lien mais peut-être que "0.88% to 2.01%" ça correspond à des constructions idiomatiques.