Pictures survive an export
A Notion, Confluence or Obsidian export kept its pictures in the .zip and never unpacked them, so the document arrived with every image pointing at a file that was not there. A PowerPoint deck lost its slides’ pictures. A Word file lost its pictures having already handed every one of them over. All four now carry them, inside the document itself.
C’était la plainte la plus fréquente à propos de deux de ces formats, et ce convertisseur l’avait aussi.
Ce qui se passait
Un export range ses images dans des dossiers et les lie relativement : Notion à côté de chaque
page, Confluence sous attachments/, Obsidian là où vous les avez mises. Seul le texte était lu
dans l’archive, si bien que le Markdown continuait d’écrire  à propos de
fichiers jamais décompressés — vingt images cassées dans un wiki converti, ce qui donne
l’impression que l’outil les a perdues plutôt qu’il ne les a jamais eues.
PowerPoint était pire en plus discret : une diapositive qui n’était qu’un schéma le disait et
passait. Word était le plus étrange des quatre, car mammoth lit les images d’un .docx dans
le fichier et les remet toutes — et une ligne posée il y a des années, jamais commentée, les
jetait.
Portées, pas téléversées
Une image devient une partie du document, avec ses propres octets. C’est la contrainte et non un raccourci : chaque conversion ici promet que le fichier reste dans le navigateur, et mettre les images dans un stockage au passage rendrait cette promesse fausse. Cela veut dire aussi qu’elles voyagent — dans le Markdown téléchargé, dans le HTML autonome, dans l’export Word, dans un lien partagé.
Il y a un plafond, et il n’est pas de nous
Un document doit tenir dans 4 Mo pour être enregistré dans un compte ; les images se partagent la moitié, un mégaoctet chacune au plus. Au-delà, une image venue d’une archive garde le lien qu’elle avait déjà — rien n’est perdu qui ne l’était déjà — et celle qui n’a aucun fichier derrière elle est remplacée par sa propre description.
Ce qui a changé la conception
La façon évidente de garder les images de Word était de cesser de les jeter. Mesuré sur un
document de 3,5 Mo contenant trois photographies : 4,7 Mo de HTML en 224 ms, puis rien — un
<img> dont l’adresse fait deux millions de caractères n’est pas ce pour quoi un analyseur HTML
est fait. Les octets ne l’approchent plus : chaque image est pesée à la lecture, mise de côté
sous un numéro, et replacée une fois le Markdown redevenu petit. Soixante millisecondes.