Fichiers
Nom, format, taille, structure, propriétés, dates, contenu et autres informations techniques associées à un fichier.
Comprendre les informations laissées par les fichiers, services, pages Web et différents usages du numérique.
Une trace numérique peut être visible, cachée dans les propriétés d'un fichier, produite automatiquement par un logiciel ou résulter du fonctionnement normal d'un service. Sa présence doit être comprise avant d'être interprétée.
Un usage numérique peut produire des informations au cours de son fonctionnement. Certaines sont créées volontairement, d'autres automatiquement par un appareil, un logiciel ou un service.
Une trace peut ainsi prendre la forme d'une date, d'une propriété de fichier, d'un identifiant, d'une URL, d'une information technique, d'une publication ou d'une entrée dans un journal informatique.
Toutes les traces ne sont pas accessibles de la même manière et elles n'ont pas toutes la même signification. L'enjeu consiste d'abord à comprendre leur origine et leur mécanisme de création.
Une trace numérique n'est pas nécessairement une donnée spectaculaire. Certaines des informations les plus utiles peuvent être très simples lorsqu'elles sont replacées dans leur contexte.
Nom, format, taille, structure, propriétés, dates, contenu et autres informations techniques associées à un fichier.
Informations décrivant un contenu : caractéristiques techniques, logiciel, dimensions, dates ou autres propriétés enregistrées avec le fichier.
URL, contenu HTML, ressources chargées, liens, informations structurées, paramètres et autres éléments transmis au navigateur.
Texte, date affichée, pseudonyme, contexte, liens, médias et informations rendues accessibles avec une publication.
Certains systèmes enregistrent des événements afin de suivre leur fonctionnement, diagnostiquer une erreur ou documenter une activité.
Références, numéros, identifiants de ressources ou autres valeurs permettant à un système de distinguer certains objets ou événements.
Format, dimensions, codec, structure, métadonnées éventuelles et contexte dans lequel le média a été publié.
Copies historiques, versions antérieures et contenus conservés pouvant aider à comprendre l'évolution d'une ressource.
Une trace prend souvent son sens grâce aux informations qui l'entourent : source, chronologie, environnement et autres éléments disponibles.
L'information observée aujourd'hui n'est pas nécessairement identique à celle qui existait au moment de sa création.
Une information est produite par l'utilisateur, le logiciel, l'appareil ou le service.
La donnée peut être enregistrée dans un fichier, une page, une base, un journal ou un autre support.
Conversion, compression, modification, copie ou publication peuvent modifier certaines caractéristiques.
Une information peut être supprimée, remplacée, désindexée ou devenir inaccessible avec le temps.
Lorsqu'une image est ouverte, nous voyons principalement son contenu visuel. Le fichier possède pourtant également une structure et différentes caractéristiques techniques.
Selon son origine et les transformations qu'il a subies, il peut contenir certaines métadonnées. Une plateforme peut également modifier le fichier lors de sa publication et supprimer une partie de ces informations.
L'absence d'une métadonnée ne permet donc pas, à elle seule, de conclure qu'elle n'a jamais existé.
Les systèmes numériques utilisent de nombreuses dates. Elles peuvent correspondre à des événements très différents.
Avant d'utiliser un horodatage, il faut donc comprendre ce qu'il représente, quel système l'a généré et s'il a pu être modifié au cours du cycle de vie de la donnée.
Une fonction de hachage peut produire une empreinte à partir du contenu d'un fichier. SHA-256 est un exemple couramment utilisé.
Si le contenu du fichier change, son empreinte change également. Enregistrer une empreinte au moment d'une collecte peut donc être utile pour vérifier ultérieurement que le fichier examiné est identique à celui qui avait été conservé.
Une empreinte ne démontre toutefois pas, à elle seule, l'origine du fichier ni l'exactitude de son contenu.
Une donnée technique constitue d'abord une observation. Sa portée dépend de sa source, de son contexte et de la question à laquelle on cherche à répondre.
Une donnée peut être générée par un utilisateur, un appareil, une application, un serveur ou un processus automatisé.
Une date de fichier, de publication ou de traitement ne représente pas nécessairement le même événement.
Copie, exportation, compression, conversion ou publication peuvent modifier certaines informations.
La provenance de l'information est souvent aussi importante que son contenu.
Plusieurs éléments indépendants peuvent permettre de mieux comprendre une chronologie ou de tester une hypothèse.
Identifier les limites d'une donnée évite de lui attribuer une signification qu'elle ne possède pas.
Cette page constitue le point d'entrée vers les tutoriels du Cyber Lab consacrés aux fichiers, métadonnées, dates, navigateurs et autres informations techniques.
Quelles informations peuvent accompagner un fichier et comment sont-elles enregistrées ?
Explorer →HTML, ressources, requêtes et autres données reçues lors du chargement d'une page Web.
Explorer →Pourquoi une valeur numérique peut représenter une date et pourquoi son contexte reste indispensable.
Lire le tutoriel →Comprendre simplement le rôle d'une empreinte numérique lors de la conservation d'un fichier.
Lire le tutoriel →Examiner les caractéristiques techniques d'un média et son contexte de publication.
Explorer →Contexte, source, date, fichier et empreinte : comprendre les informations qu'il peut être utile de documenter.
Explorer →Une métadonnée, un horodatage, un identifiant, une empreinte numérique ou une information issue d'un navigateur peut apporter un élément utile. Mais la présence d'une donnée ne suffit pas nécessairement à expliquer pourquoi elle existe ni à identifier la personne à l'origine d'une action.
Il convient notamment de distinguer l'observation technique, l'hypothèse qui peut en découler et les éléments permettant éventuellement de confirmer ou d'écarter cette hypothèse.
Continuez l'exploration avec les métadonnées, les technologies Web, l'OSINT et les autres domaines du Cyber Lab.