• [^] # Re: Questions en vrac

    Posté par . En réponse à la dépêche Grammalecte, correcteur grammatical. Évalué à 4. Dernière modification le 28 avril 2015 à 15:47.

    Diantre ! Autant de fautes dans un commentaire sur les correcteurs grammaticaux. Je la refais

    Merci pour cet article passionnant qui m'a permis de découvrir ce domaine.

    A travers cette lecture plusieurs questions m’ont traversé l'esprit.
    Pourquoi es-tu si réticent vis-à-vis de la "tokenisation" ?
    Après tout la grammaire se base dessus, et c'est le processus "naturel" que chacun applique.
    Ne crains-tu pas que l'explosion combinatoire des règles que tu mets en place (même après les phases de simplification) et la cohérence entre ces règles ne finissent par rendre le logiciel trop lent ?

    Concernant le lien avec Hunspell:
    Il semble qu'il soit disponible sous forme d'un lib C++ et également d'un service.
    Est-on vraiment obligé d'en passer par un couplage avec OO/LO ?
    Pourquoi ne pas analyser des textes bruts plutôt que des ODF pour tes TUs ?

    De même pourrais-tu détailler un peu la solution que tu envisages pour la "désambiguisation", car même après la lecture de ton billet, je ne comprends pas très bien ce que serait un "index de balises" ?

    Concernant ta structure pour stocker le vocabulaire et la nature grammaticale des mots, ne crains tu pas que ceci ne puisse plus te permettre de proposer des suggestions sur des mots mal orthographiés dès le début.
    Par exemple: embiguïté

    Enfin aurais-tu quelques références à nous indiquer pour effleurer ce sujet, car des adjectifs épicènes, des lemmes, des thesaurus, ... Je comprends un peu ce dont il pourrait s'agir, mais j'imagine que ça doit être bien décrit de façon formelle quelque part.

    Encore merci pour ce billet captivant et très bien écrit et bonne chance pour ta campagne de dons.