Pourquoi blâmer le format quand on l'utilise mal ? (sciemment ou avec un outil qui foire dans l'utilisation/exploitation du format...)
Dans le principe des échanges/transferts de données tabulaires, les formats à délimiteursconviennent (il est important de noter qu'il y a des conventions/normes à respecter pour que ça marche bien)
de ne pas avoir de métas-information, ce qui implique qu'il ne faut pas faire de devinette et s'en tenir à ce qui est convenu (sinon on s'expose à des déconvenues dont les pertes de données mentionnées)
d'utiliser des fichiers purement textuels avec directement les données, ce qui implique de se mettre d'accord sur un encodage
pour chaque ligne d'avoir toutes les colonnes, en se mettant d'accord sur un caractère qui sert de délimiteur (et qui donc ne doit pas apparaître dans les contenus des cellules ...à moins de complexifier en prévoyant une méthode d'échappement)
la virgule (Comma) pour du CSV
le point-virgule (Semicolon) que j'aime indiquer par SSV
la tabulation pour du TSV
les deux points (colon) comme les bases systèmes UNIX et que j'aime indiquer par USV
la barre verticale (Pipe) que j'aime indiquer par PSV
etc. (voir même juste l'espace dans certains cas)
Bien, ayant ceci à l'esprit, on voit que l'appellation CSV a été abusée pour tout et n'importe quoi... Beaucoup d'ajouts (dont l'usage de double-guillemets-droits) ont cependant fini par être standardisé dans la RFC 4180 Malgré cela, beaucoup d'outils :
n'utilisent pas le bon marqueur de fin de ligne (les mauvais élèves ici viennent souvent du monde Unixien) mais bon ce travers semble bien toléré
n'utilisent pas le bon formatage des nombres et surtout séparateur décimal (le pire élève ici est μ$ Excel qui sort des données localisées en oubliant que le format doit servir à interéchanger)
échappent la virgule avec le contre-oblique au lieu de mettre la cellule concernée entre double-guillemets-droits
échappent le double-guillemet-droit au lieu de le doubler dans une cellule entourée de double-guillemets-droits
n'utilisent pas le bon séparateur (ici aussi, μ$ Excel produit du SSV —en particulier quand la virgule peut apparaître dans les nombres— et fait passer ça pour du CSV ; en fait avec μ$ on peut utiliser n'importe quel séparateur via un hack de la première ligne)
Faire n'importe quoi est une façon de torpiller/saboter l'échange. Bien que la firme de Redmond ne soit pas seule fautive, je la fustige car elle est (et se veut) la plus utilisée (et donc un standard de fait pour certains) et donc il est criminel de sa part de répandre massivement ce qu'il ne faut pas faire.
Il y a d'autres formats d'échange qui suivent d'autres modèles que DSV. Deux d'entre eux, adaptés aux tableurs (pour préserver les formules —et donc avoir des cellules calculées dynamiquement— et le formatage —au moins distinguer les nombres avec leur affichage et du texte standard avec leur justification— dans ce cas) ont été évoqué. Mais il faut malheureusement constater que
μ$ fait parti de ceux qui ne respectent pas correctement le DIF spreadsheet et ce de façon incompatible avec les autres éditeurs (si c'est pas une tentative de sabotage c'est alors la preuve que ces gens sont plus qu'incompétents et dans les deux cas il faudrait cesser de leur filer bêtement des sous)
μ$ met en place son propre format (ce qui peut expliquer le sabotage), au demeurant avec d'étranges limitations, mais n'est pas capable d'avoir une compatibilité intégrale (remarque que c'est le cas pour tous ses formats quand ce n'est pas lui-même qui viole ses propres spécifications)
C'est bizarre, mais chaque fois que Bill et ses acolytes sont dans la danse ça part en vrille... Le salut est donc dans le fait de virer ces trucs là pour commencer, et de respecter les formats d'échange.
"It is seldom that liberty of any kind is lost all at once." ― David Hume
# non, en finir μ$ et autres irrespects
Posté par Gil Cot ✔ (site web personnel, Mastodon) . En réponse au journal En finir avec CSV ou Excel pour échanger des données. Évalué à 4.
Pourquoi blâmer le format quand on l'utilise mal ? (sciemment ou avec un outil qui foire dans l'utilisation/exploitation du format...)
Dans le principe des échanges/transferts de données tabulaires, les formats à délimiteurs conviennent (il est important de noter qu'il y a des conventions/normes à respecter pour que ça marche bien)
Bien, ayant ceci à l'esprit, on voit que l'appellation CSV a été abusée pour tout et n'importe quoi... Beaucoup d'ajouts (dont l'usage de double-guillemets-droits) ont cependant fini par être standardisé dans la RFC 4180 Malgré cela, beaucoup d'outils :
Faire n'importe quoi est une façon de torpiller/saboter l'échange. Bien que la firme de Redmond ne soit pas seule fautive, je la fustige car elle est (et se veut) la plus utilisée (et donc un standard de fait pour certains) et donc il est criminel de sa part de répandre massivement ce qu'il ne faut pas faire.
Il y a d'autres formats d'échange qui suivent d'autres modèles que DSV. Deux d'entre eux, adaptés aux tableurs (pour préserver les formules —et donc avoir des cellules calculées dynamiquement— et le formatage —au moins distinguer les nombres avec leur affichage et du texte standard avec leur justification— dans ce cas) ont été évoqué. Mais il faut malheureusement constater que
C'est bizarre, mais chaque fois que Bill et ses acolytes sont dans la danse ça part en vrille... Le salut est donc dans le fait de virer ces trucs là pour commencer, et de respecter les formats d'échange.
"It is seldom that liberty of any kind is lost all at once." ― David Hume