Merci beaucoup pour ce programme. Il fonctionne vraiment pas mal.
Je l'ai testé avec une liste de prix fournisseur, PDF 2,1MB, 77 pages, 760 lignes x 5 colonnes de tableaux.
Il est juste un peu lent (7min34 preview + 20sec export CSV), mais ce n'est pas là le plus important pour moi, c'est toujours beaucoup plus rapide que de le faire à la main.
Un peu consommateur de ressource. 700MB de RAM pour un pdf de 2,1MB (avec Ruby sur Java c'est normal)
L'interface utilisateur est très bien faite et facile. L'auto-détection de tableau a parfaitement fonctionné sur mon test. Il devait y avoir +-300 petits tableaux.
L'installation est "plug and play", je redoutais le pire avec Ruby. (expérience passée) Mais le fait qu'il soit packagé dans du Java aide sur ce point.
Il n'est pas compatible avec les processeurs multi-coeur (multiprocessing). Je n'en ai qu'un seul thread à 100% avec 4 cores.
Il doit y avoir des fuites mémoires, après plusieurs itérations la mémoire RAM augmente. Après 2 itérations et on en est à 780MB de RAM total.
# Extraordinaire
Posté par zyphos . En réponse à la dépêche Sortie de Tabula 1.0.1 - Extraction de données tabulaires dans des pdfs. Évalué à 10.
Merci beaucoup pour ce programme. Il fonctionne vraiment pas mal.
Je l'ai testé avec une liste de prix fournisseur, PDF 2,1MB, 77 pages, 760 lignes x 5 colonnes de tableaux.