• [^] # Re: Ça vous sert à quoi au quotidien ?

    Posté par (site web personnel) . En réponse au journal Auto-héberger ses LLM (IA) : Débordement CPU+RAM, Mixture-of-Experts et Benchmarks. Évalué à 4 (+1/-0).

    Alors si il y a une mauvaise utilisation de l'IA c'est bien ça. Wikipedia te le dis de manière certaine et surtout à jour (ça bouge les capitales !).

    Bien sur, mais si je tape la demande sur Google ou DDG, et qu'une vignette s'affiche avec le résultat, et est ce que j'ai demandé à une IA si je ne vais pas sur Wikipedia ?

    Et je suis d'accord que pour mon exemple qui marche parfaitement, c'est aussi un cas trivial ou ça marche sans LLM (et quand je déploie des modéles, j'envoie toujours 2/3 questions qui semblent trivial mais qui ne le sont pas, comme la durée de train Paris vers New York...). Mais je pense qu'il y a sans doute des demandes plus complexes qui ne vont pas sur WP directement pour illustrer le pouvoir du pattern matching.

    Tu demandes un contenu éditorialisé

    Certes, mais quand je demande ça sur un moteur de recherche, j'ai plus de choix, par fonctionnement d'un moteur de recherche. Et ce point sur le contenu éditorialisé est en fait important.

    donc c'est difficile de reprocher à chacune de pas être celle que tu attendais

    Nan, c'est pas difficile du tout, je viens de le faire :P
    Mais mon point, c'était surtout qu'on peut pas faire confiance assez rapidement, donc prendre 3h pour un truc qui semble prendre 5 minutes me semble une simplification.

    Pour le code (la question c'était "au quotidien", moi c'est le code) les hallucinations il n'y en a quasiment pas dès lors que tu utilises un agent (et pas 3 copier/coller sur le web).

    Mais ça pose la question des biais. Un agent, c'est juste l'automatisation de la vérification des résultats. On va battre les hallucinations par le pouvoir des stats et une boucle (boucle qui au passage devrait être en logiciel libre, mais curieusement un point absent des discussions en général), en gros, ça bruteforce (une approche valable, je précise).

    Mais si il y a des biais dans une demande que tu qualifie d'éditorial comment ça se manifeste dans le code ?

    Je précise que je dit "qualifie d'éditorial" parce je suis d'accord avec toi, mais je ne trouve pas de meilleur mot, et j'ai le sentiment qu'il y en a un.

    On force la forme que prends le code via l'usage des linters, on force le code à être correct via des tests et un compilo (quand c'est possible), et ça n'est pas un processus créatif ou éditorial, mais est ce qu'il y a plus que ça qui rentrerait dans la catégorie "editorial", et est ce que c'est important ?

    Pour répondre à la seconde question, je pense que c'est important.

    Vu que la protection via les droits d'auteurs du code dépend du fait qu'il y a un élément créatif (cf cette article), si on estime que le code produit n'est pas comparable au résultat d'une demande "éditorial", alors même si un humain sélectionne le code, on peut argumenter qu'il n'y rien de créatif, donc rien de protégeable (avec tout ce que ça implique).

    Si au contraire, on estime que l'humain qui va examiner ce que produit le LLM est capable de faire un choix éditorial, alors ça veut dire que le code produit par les LLMs souffre de biais comme le programme des cinés clubs produit par un LLM.

    Et donc, si on estime qu'il y a des biais, comment ça se manifeste dans le code en pratique ?

    (question ouverte, j'ai pas assez réfléchi pour avoir un avis, et on m'a filé un angine ce weekend)