Toute la difficutslté d'un projet informatique, ce n'est pas d'écrire le code, mais de s'assurer que le code fait bien ce qui est demandé dans la spécification (ou que la documentation documente bien ce que fait le code).
Du code généré par un LLM fait ça moins bien qu'un déâeloppeur, et si on lui dit "hé, tu t'es trompé, c'est pas ce qu'on t'a demandé" il va répondre "oh, je suis désolé, vous avez raison, voici le code corrigé" et remettre un bout de code avec le même bug.
Dans le cas d'une traduction d'un langage à un autre, il faudrait entraîner un modèle spécial en lui fournissant du code c++ et la version traduite. Puis lui demander de "faire la même chose" sur d'autres morceaux de code. Le tout avec des tests pour valider si les traductions générées fonctionnent (@qui doivent être écrits au cas par cas, j'imagine?). Quel volume de code et de tests faut-il traduire à la main avant d'avoir assez de données pour avoir un traducteur fonctionnel? Est-ce qu'il restera encore du code non traduit quelque part une fois cet entraînement terminé?
[^] # Re: Je me méfie quand il s'agit de nos amis états-uniens
Posté par pulkomandy (site web personnel, Mastodon) . En réponse au lien La DARPA veut traduire automatiquement le code C/C++ en Rust. Évalué à 2.
Non.
Toute la difficutslté d'un projet informatique, ce n'est pas d'écrire le code, mais de s'assurer que le code fait bien ce qui est demandé dans la spécification (ou que la documentation documente bien ce que fait le code).
Du code généré par un LLM fait ça moins bien qu'un déâeloppeur, et si on lui dit "hé, tu t'es trompé, c'est pas ce qu'on t'a demandé" il va répondre "oh, je suis désolé, vous avez raison, voici le code corrigé" et remettre un bout de code avec le même bug.
Dans le cas d'une traduction d'un langage à un autre, il faudrait entraîner un modèle spécial en lui fournissant du code c++ et la version traduite. Puis lui demander de "faire la même chose" sur d'autres morceaux de code. Le tout avec des tests pour valider si les traductions générées fonctionnent (@qui doivent être écrits au cas par cas, j'imagine?). Quel volume de code et de tests faut-il traduire à la main avant d'avoir assez de données pour avoir un traducteur fonctionnel? Est-ce qu'il restera encore du code non traduit quelque part une fois cet entraînement terminé?