HeadlinesBriefing HeadlinesBriefing.com

Texte brut en informatique

Hacker News •
×

Il n'y a pas beaucoup de formats de fichiers informatiques dont je ferais confiance pour rester lisibles dans cinquante ans, mais le texte brut en fait partie. Un fichier texte ne peut pas intégrer une feuille de calcul ni conserver des mises en page élaborées, mais il stocke le texte sous l'une des formes les plus simples et les plus largement comprises en informatique. La norme Unicode définit le texte brut comme une séquence de codes de caractères, sans informations de formatage supplémentaires. Je peux créer un fichier texte sur Linux, le copier sur une machine Windows, le placer sur un serveur web, l'ouvrir dans un terminal, le rechercher avec des outils en ligne de commande ou le modifier avec n'importe quel programme. Très peu du fichier dépend de la façon dont il a été créé.

Le texte brut n'est pas une technologie oubliée. Il reste une partie de la plomberie de base de l'informatique. Le code source, les fichiers de configuration et les fichiers journaux sont généralement du texte. Les systèmes Unix et Linux sont pleins de fichiers texte. HTML, XML, JSON, CSS, scripts shell et langages de programmation sont construits autour de caractères que les humains peuvent inspecter. Quand quelque chose ne va pas avec un fichier de configuration texte, je peux l'inspecter directement, le copier, comparer les versions ou faire une sauvegarde sans avoir besoin du programme qui l'a créé.

L'une des plus grandes forces du texte brut est qu'une énorme collection d'outils sait déjà comment travailler avec. Sur un système de type Unix, un fichier texte peut être confié à grep, sed, awk, sort, diff et bien d'autres utilitaires. Un script peut traiter des milliers de fichiers sans prétendre être un humain cliquant sur des menus. Le véritable avantage est que l'information n'est pas étroitement couplée à une interface. Le texte brut laisse plus de choix à l'utilisateur.

Source: Hacker News · Résumé par HeadlinesBriefing