Données formatées de sorte que les logiciels puissent les extraire et les traiter automatiquement sans interprétation manuelle.
Les données lisibles par machine utilisent des formats structurés que les programmes peuvent analyser directement — CSV, JSON, XML et GeoJSON sont lisibles par machine. Un tableau PDF ou une image numérisée d'un tableur n'est pas lisible par machine car les logiciels ne peuvent pas extraire les valeurs de manière fiable sans intervention humaine.
La lisibilité par machine est une exigence fondamentale pour les données ouvertes. Les données publiées uniquement en PDF ou en images obligent les utilisateurs à ressaisir manuellement les valeurs, ce qui introduit des erreurs et limite la réutilisation.
Exemple : Une ville publie son budget en deux formats : un PDF formaté pour la lecture humaine et un fichier CSV pour le traitement automatique. Le CSV est lisible par machine — un développeur peut écrire un script pour télécharger, analyser et visualiser automatiquement les données budgétaires sans aucune étape manuelle.
La définition ouverte et le modèle des cinq étoiles de données ouvertes traitent tous deux la lisibilité par machine comme une exigence minimale pour des données genuinement ouvertes.