Avec
du texte, y parait y avoir moins de segmentation fault, mais il en
subsiste, et assez souvent.
Ne serait-ce pas à cause de certains caractères? Car souvent tesseract
indique un problème d'unclosed tag : '<|>|...'. Peut-être cela
vient de là et hocr2pdf plante à cause de certains caractères?
[^] # Re: tesseract => text => pdf
Posté par dafp . En réponse au message Correcteur format html automatique pour hocr2pdf qui fait des segmentation fault un peu partout. Évalué à 0.
Avec
du texte, y parait y avoir moins de segmentation fault, mais il en
subsiste, et assez souvent.
Ne serait-ce pas à cause de certains caractères? Car souvent tesseract
indique un problème d'unclosed tag : '<|>|...'. Peut-être cela
vient de là et hocr2pdf plante à cause de certains caractères?