Je pense que le recours à un format qui n'est pas un format d'archive doit être dû au traitement en base de données, c'est la seule explication que je vois.
Quel rapport ? PDF est parsable également, soit c'est très facile (texte embarqué proprement), soit c'est plus compliqué (texte vectorisé ou carrément des gros bitmaps genre sortie de scanner). Mais c'est la même chose pour docx qui peut soit embarquer le texte sous forme de texte ou alors n'être qu'un assemblage d'image ce qui sera délicat à parser.
Pour ma part, je pense plutôt que ce doit être le reliquat d'une très vieille époque où les alternatives à la suite Microsoft étaient rares, déconsidérées et peu utilisées. Ceci dit même si ça est un peu amélioré au fond ça n'a changé qu'à la marge.
[^] # Re: Pourquoi un format de fichier bureautique ?
Posté par guppy . En réponse à la dépêche La nouvelle plate‐forme de dépôt de brevet de l’INPI en contradiction avec le RGI. Évalué à 2.
Quel rapport ? PDF est parsable également, soit c'est très facile (texte embarqué proprement), soit c'est plus compliqué (texte vectorisé ou carrément des gros bitmaps genre sortie de scanner). Mais c'est la même chose pour docx qui peut soit embarquer le texte sous forme de texte ou alors n'être qu'un assemblage d'image ce qui sera délicat à parser.
Pour ma part, je pense plutôt que ce doit être le reliquat d'une très vieille époque où les alternatives à la suite Microsoft étaient rares, déconsidérées et peu utilisées. Ceci dit même si ça est un peu amélioré au fond ça n'a changé qu'à la marge.