• [^] # Re: trouver la langue d'un texte

    Posté par . En réponse au journal trouver la langue d'un texte. Évalué à 2.

    j'étais (et je pense l'être toujours) assez féru de grammaire et d'orthographe
    mais je crois que là tu m'as scotché :-)
    c'est quoi le "Il faut que tu arriveras à laisser les solutions dialectiques et sinusoidales de la pseudo facilité"
    c'est tiré d'un sketche de "Les inconnus" ? :-)

    OK, on va rester simple et pragmatique,
    je ne veux pas non plus réinventer un moteur de la complexité de celui de Google.

    je m'en tiens pour l'instant aux principales langues européennes, que je classe dans 4 grandes catégories (j'ai bon ?):
    - latines (français/canadien, italien, espagnol, portuguais/brésilien)
    - anglo-saxonnes (anglais/américain, allemand, autrichien, hollandais, flamant)
    - nordiques (suédois, norvégien, finlandais, danois)
    - slaves d'alphabets non-cyrilliques (polonais, tchèque, slovaque, roumain, hongrois, slovène, bulgare?)

    donc pas de cyrillique, pas d'arabe, pas de chinois/japonais/coréen, pas de sanscrit, pas de hiéroglyphes et pas de langue "Elvish" :-)
    je reste sur les 26 lettres de l'alphabet et leurs dérivées accentuées...

    ou alors si je faisais ça pour toutes les langues, faudrait que je pense linguistique globale.... et que je code en Unicode, et là j'ai pas fini, effectivement......

    enfin merci du conseil, je vais aller creuser l'aspect linguistique de Perl....