Bref, un modèle entraîné sur des données propriétaires (mais téléchargeables gratuitement) respecte les libertés fondamentales.
bin, non : tu ne maîtrises pas la disponibilité dans le temps/la durée de ces données non libres
elles peuvent évoluer, hors de ta maîtrise, vu que ça dépend d'un tiers
elles peuvent disparaître (et c'est ballot, vu que tu ne peux pas les redistribuer, une sauvegarde ne servirait à rien dans ce cas)
cela ne respecte pas complètement le principe d'expérimentation à données maîtrisées (changer tes algos, mais pas le jeu de données, pour mesurer l'efficacité de tes algos), notamment cela peut gêner la reproductibilité par d'autres équipes que la tienne (tu ne peux pas fournir ton corpus exact d'entraînement, vu que tu dépends d'un tiers)
Est-ce que si mon modèle a été entraîné avec des données sous copyright, je peux l'utiliser? Clairement le consensus actuel est "oui"
oula, pas complètement...
Demande aux journaux qui ont intenté des procès pour plagiat :-) (je ne me prononce pas sur leur légitimité) ou même du code GPL ou BSD reproduit à l'identique par une IA : c'est un sujet d'actualité, non encore statué (je réserve mon avis :D)
[^] # Re: Any purpose
Posté par BAud (site web personnel) . En réponse au journal L'OSI publie une définition de l'IA "opensource"... mais pas trop?. Évalué à 1. Dernière modification le 03 novembre 2024 à 14:41.
bin, non : tu ne maîtrises pas la disponibilité dans le temps/la durée de ces données non libres
oula, pas complètement...
Demande aux journaux qui ont intenté des procès pour plagiat :-) (je ne me prononce pas sur leur légitimité) ou même du code GPL ou BSD reproduit à l'identique par une IA : c'est un sujet d'actualité, non encore statué (je réserve mon avis :D)