• [^] # Re: Technique de recoupement

    Posté par (site web personnel) . En réponse au journal Bannissement d'un utilisateur et évolution de la modération. Évalué à 10.

    Désolé si dans la centaine de commentaires j'ai raté la réponse, mais techniquement, quelles sont les techniques que vous avez utilisées pour recouper les 40+ comptes ?

    Il n'y a pas besoin de beaucoup de technique dans le cas présent vu que les comptes étaient revendiqués (numérotation des identifiants, avatars communs, revendication par commentaire, etc.). La technique (dont les données et métadonnées échangées lors des échanges avec le site, plus les données et métadonnées échangées lors des échanges avec l'équipe par d'autres canaux) vient uniquement en complément, pour confirmer par exemple.
    On n'a pas fait pas d'analyse sur les données en l'occurrence (type analyse de style, de vocabulaire, etc.), il suffisait de regarder les notes les plus basses pour trouver ou de lire pour reconnaître les propos (sans parler des signalements faits par d'autres humains). Rien de compliqué donc.

    A priori pas vraiment de risque de faux négatif/positif dans un contexte basé sur la revendication. Et les confirmations par les métadonnées évitent le faux positif.

    D'ailleurs le souci du cas présent n'est pas tant de détecter que d'empêcher le retour / bannir (ce qui revient à dire comment faire du pre-crime au moyen de valider un nouveau compte en inférant qu'un futur nouveau compte est un compte de spammeur inconnu ou pire un compte de pénible déjà connu).

    Dans ces techniques, y a-t-il moyen de savoir si c'est une personne physique ou un groupe de personnes qui agissent comme une seule ?

    Il n'y a pas vraiment de solution technique au problème je dirais : on ne peut savoir si c'est une personne, plusieurs, une IA, un chien ou un pangolin qui écrivent. Dans l'absolu, je dirais même que LinuxFr.org s'en fiche un peu : c'est la nature de ce qui est écrit, la fréquence, le comportement, le respect des règles qui comptent. On ne délivre pas des blasons de « comptes vérifiés », on ne demande pas des copies de documents d'identité, on n'a pas d'authentification par France Connect ou l'identification mise en place par les autorités d'un quelconque pays, etc. Bref on n'a pas vraiment d'intérêt à chercher si un compte utilisateur est une ou plusieurs personnes.

    La question est un peu différente si on cherche à savoir si plusieurs comptes actifs sont contrôlés par un seul et même groupe. En l'occurrence c'est plutôt l'entre-soi (s'auto-noter au sens de son groupe) ou la comportement de meute (tout le groupe agit identiquement ou presque) qui sont à détecter (ie. on s'en fiche que ça soit contrôlé par un ou plusieurs humains là, on veut juste savoir s'il y a une action coordonnée).

    Ça ne couvre pas le cas de l'orientation de la communication par exemple : un groupe qui envoie uniquement des informations sur un sujet donné pour influencer le reste des personnes du site (ils ne sont pas obligés de tenter de manipuler les notes pour ça, il suffit de faire comme les partis politiques ces derniers temps en envoyant "il faut que vous parliez de ça et ça" (éléments de langage) sur tel site, le tout via un canal de communication caché, et ensuite une meute d'humains va venir faire la communication, et faire indirectement croire que le sujet passionne le lectorat ou que c'est la position du lectorat).

    Globalement on passe beaucoup (trop) de temps à rajouter des moyens de détection / protection / réparation pour lutter contre les spammeurs, le SEO, les pénibles, etc. Et au bout d'un moment la solution peut ne pas rester que seulement technique dans une course à l'armement sans fin, elle peut aussi devenir juridique (ie. demander l'aide des autorités compétentes).