• # Questions en vrac

    Posté par . En réponse à la dépêche Grammalecte, correcteur grammatical. Évalué à 2.

    Merci pour cette article passionnant qui m'a permis de découvrir ce domaine.

    A travers cette lecture plusieurs question mon traversé l'esprit.

    Pourquoi es-tu si réticent vis-à-vis de la "tokenisation" ?
    Après-tout la grammaire se base dessus, et c'est le processus "naturel" que chacun applique.
    Ne crains-tu pas que l'explosion combinatoire des règles que tu mets en place (même après les phases de simplification) et la cohérence entre ces règles ne finissent par rendre le logiciel trop lent ?

    Concernant le lien avec Hunspell:
    Il semple qu'il soit disponible sous forme d'un lib C++ et également d'un service.
    Es-t'on vraiment obligé d'en passer par un couplage avec OO/LO ?
    Pourquoi ne pas analyser des textes bruts plutôt que des ODF pour tes TUs ?

    De même pourrais-tu détailler un peu la solution que tu envisages pour la "désambiguisation", car même après la lecture de ton billet je ne comprends pas très bien ce que serait un "index de balises" ?

    Concernant ta structure pour stocker le vocabulaire et la nature grammaticale des mots, ne crains tu pas que ceci ne puisse plus te permettre de proposer des suggestions sur des mots mal orthographiés dès le début.
    Par exemple: embiguïté

    Enfin aurais-tu quelques références à nous indiquer pour effleurer ce sujet, car des adjectifs épicènes, des lemmes, des thesaurus, ..., je comprends un peu ce dont il pourrait s'agir mais j'imagine que ca doit être bien décrit de façon formelle quelque part.

    Encore merci pour ce billet captivant et très bien écrit et bonne chance pour ta campagne de dons.