• [^] # Re: pratique

    Posté par . En réponse à la dépêche Apertium français-espagnol 0.8.0 vient de sortir. Évalué à 3.

    Je vais d'abord expliquer brièvement l'organisation des données linguistiques.

    Elles sont réparties en cinq fichiers XML

    - un dictionnaire monolingue pour la langue source de la traduction. Ce dictionnaire comporte la liste des mots et le paradigme correspondant. Je m'explique, par exemple pour « chanter », les contributeurs ne vont pas indiquer toute la conjugaison, mais simplement dire que « chanter » se conjugue comme « aimer ». « aimer » est donc le paradigme de « chanter » et bien sûr aussi de « rouler », « donner », « danser », etc.
    Les paradigmes contiennent des informations sur la morphologie des mots c'est-à-dire quelles sont les terminaisons des verbes, des noms, des adjectifs, etc selon qu'ils soient au singulier, pluriel, à la première personne, etc
    - idem pour la langue cible de la traduction

    - un dictionnaire bilingue qui associe un mot de la langue source et sa traduction dans la langue cible.

    - des règles de transfert pour passer de la langue source à la langue cible. Ce sont en quelques sortes, les règles de grammaire.

    - idem mais pour traduire en inversant la langue source et la langue cible.


    Les dictionnaires monolingues sont déjà disponibles pour l'espéranto, l'anglais, le français et peuvent donc être réutilisés.

    Pour les dictionnaires bilingues on peut se baser sur des outils automatiques disponibles dans Apertium pour les générer. Un exemple sera plus clair. Les pairs espagnol-espéranto espagnol-français existent.

    Nous avons donc quelque part dans les dictionnaires bilingues d'Apertium (de manière schématique) « perro --> hundo » et « perro --> chien ». L'outil « crossdic » va générer automatiquement « hundo--> chien ».

    Conclusion, se sont les règles de transferts qui sont les plus ardues. Mais des développeurs sont près à vous aider par email (https://lists.sourceforge.net/lists/listinfo/apertium-stuff) ou par irc. (http://xixona.dlsi.ua.es/cgi-bin/cgiirc/irc.cgi)
    Les contributeurs pour la paire espéranto-français sont les bienvenues.