Je suis pas certain de ce que je dis mais ... Ils sont optimisés pour faire un modèle minimum d'erreur sur un certain corpus.
Ça les "tire" dans une direction, c'est leur "raison d'être". Dans un dialogue, ça peut potentiellement induire de "l'intentionnalité" avec le contexte "tu est un chatbot, tu réponds a des questions ..." du pre-prompt (que des gens s'amusent à "jailbreaker" pour faire sortir le llm de ces instructions. Là on a un genre de jeu qui se met en place ... Le llm est conçu pour donner un texte qui répond aux instructions, l'utilisateur veut le faire sortir du script.
Le llm est conçu pour faire un minimum d'erreur, donc pour répondre quelque chose d'approprié dans ce contexte (ce ne sont plus strictement des erreurs vu qu'il n'y a plus de corpus). Là ... Il y gaming. "Vous allez essayer de me faire sortir du script, je veux pas alors je suis conçu pour vous donner une réponse générique telle que celle là". C'est prévu de base tu me diras mais il y a un méta jeu qui fait que si fondamentalement oui, un llm prédit le mot suivant il se passe bien d'autres choses (post apprentissage, pre-prompt, autre?) pour obtenir un certain résultat et lui donner des "objectifs" à atteindre autre.
Et puis si on est plus éthéré on peut se demander si en avalant des tonnes d'exemple de jeu il finisse par émerger des capacités où elle " comprend" dans une certaine mesure ce que veux dire "gagner avun jeu, que pour prédire le coup suivant elle acquière des rudiments de tactique qu'elle met en place dans le dialogue. Oui c'est le résultat du corpus, et alors ? On lui demande bien ça ...
[^] # Re: pas mieux, je ne comprends ias l'emballement
Posté par thoasm . En réponse au journal Je suis perdu et je pensais m'être renseigné.... Évalué à 6. Dernière modification le 14 février 2025 à 09:39.
Je suis pas certain de ce que je dis mais ... Ils sont optimisés pour faire un modèle minimum d'erreur sur un certain corpus.
Ça les "tire" dans une direction, c'est leur "raison d'être". Dans un dialogue, ça peut potentiellement induire de "l'intentionnalité" avec le contexte "tu est un chatbot, tu réponds a des questions ..." du pre-prompt (que des gens s'amusent à "jailbreaker" pour faire sortir le llm de ces instructions. Là on a un genre de jeu qui se met en place ... Le llm est conçu pour donner un texte qui répond aux instructions, l'utilisateur veut le faire sortir du script.
Le llm est conçu pour faire un minimum d'erreur, donc pour répondre quelque chose d'approprié dans ce contexte (ce ne sont plus strictement des erreurs vu qu'il n'y a plus de corpus). Là ... Il y gaming. "Vous allez essayer de me faire sortir du script, je veux pas alors je suis conçu pour vous donner une réponse générique telle que celle là". C'est prévu de base tu me diras mais il y a un méta jeu qui fait que si fondamentalement oui, un llm prédit le mot suivant il se passe bien d'autres choses (post apprentissage, pre-prompt, autre?) pour obtenir un certain résultat et lui donner des "objectifs" à atteindre autre.
Et puis si on est plus éthéré on peut se demander si en avalant des tonnes d'exemple de jeu il finisse par émerger des capacités où elle " comprend" dans une certaine mesure ce que veux dire "gagner avun jeu, que pour prédire le coup suivant elle acquière des rudiments de tactique qu'elle met en place dans le dialogue. Oui c'est le résultat du corpus, et alors ? On lui demande bien ça ...