Pour les scans, mis à part de l'OCR ya pas grand choix .... J'ai bossé dans ma mission précédente avec des gens qui ont mis en place une API en python permettant de faire ce genre de truc. Par contre en terme de consommation ressource c'est pas neutre.
Après faut bien que le service ADV soit conscient que tout ne passera pas forcément. Mais tu pourras peut-être faire du PDF scanné => Texte => tableur (il y a des libs python qui permettent égalemeznt de le faire).
# Encore des gens qui croient que l'info c'est magique ...
Posté par totof2000 . En réponse au message Convertir un pdf en Office. Évalué à 3. Dernière modification le 19 avril 2021 à 23:03.
Pour les scans, mis à part de l'OCR ya pas grand choix .... J'ai bossé dans ma mission précédente avec des gens qui ont mis en place une API en python permettant de faire ce genre de truc. Par contre en terme de consommation ressource c'est pas neutre.
https://towardsdatascience.com/how-to-extract-text-from-images-using-tesseract-ocr-engine-and-python-22934125fdd5?gi=626c6d729b93
https://www.geeksforgeeks.org/python-reading-contents-of-pdf-using-ocr-optical-character-recognition/
Après faut bien que le service ADV soit conscient que tout ne passera pas forcément. Mais tu pourras peut-être faire du PDF scanné => Texte => tableur (il y a des libs python qui permettent égalemeznt de le faire).