7DaysAutomatisation des process
Cas d’usage · Documents et données

Classer et renommer des fichiers automatiquement

Un fichier mal rangé n’est pas perdu : il est introuvable. C’est pire, parce qu’on le cherche.

Un classement automatisé surveille un point d’arrivée — boîte mail, dossier partagé, téléphone —, identifie de quoi il s’agit à partir du contenu et du contexte, renomme selon votre convention et range dans le bon dossier. Sur des documents récurrents, la fiabilité dépasse largement celle du classement manuel, qui dépend de l’attention de la personne un vendredi à dix-huit heures.

DéclencheurUn fichier est déposé
L’automateExtrait, vérifié, rangé
VousVous validez les cas douteux

Aujourd’hui, à la main

2 à 4 minutes par document, et une arborescence qui dérive en quelques mois.

Une fois automatisé

Quelques secondes, et une convention de nommage respectée à cent pour cent.

À savoir

Le gain réel n’est pas le rangement : c’est le temps de recherche, qui disparaît.

Le vrai coût du désordre

Il n’est pas dans le rangement — deux minutes par document, on s’en accommode. Il est dans la recherche.

Une pièce qu’on ne retrouve pas coûte dix à trente minutes, souvent à plusieurs personnes, et parfois un appel au client pour la redemander. Un dossier photo incomplet coûte une position de faiblesse dans une discussion de fin de chantier. Une facture classée au mauvais endroit revient en question au moment du bilan, six mois plus tard.

Et le désordre est cumulatif : une arborescence tenue par trois personnes avec trois logiques dérive en quelques mois, quelles que soient les bonnes intentions du départ.

Ce qu’on automatise

La collecte. Un point d’arrivée unique : une boîte dédiée, un dossier surveillé, un numéro auquel on envoie des photos. Tout y converge, quelle que soit la source.

L’identification. De quel type de document s’agit-il, à quel client ou chantier se rattache-t-il, de quelle date.

Le renommage. Selon votre convention, écrite une fois : date, client, type, référence. Le même format pour tout le monde et pour toujours.

Le rangement. Dans l’arborescence existante, en créant le dossier client ou chantier s’il manque.

La trace. Quel fichier est arrivé, quand, d’où, où il a été rangé. Utile quand quelqu’un jure avoir envoyé quelque chose.

Comment ça marche techniquement — pour qui veut le détail

La surveillance. Un dossier local se surveille par systemd path unit sous Linux ou par un observateur de système de fichiers, qui réagit à la seconde sans interroger en boucle. Une boîte mail se lit en IMAP. Un espace partagé en ligne expose généralement des notifications de changement.

L’identification. Trois couches, de la moins chère à la plus chère. D’abord les métadonnées : type MIME réel — pas l’extension, qui ment —, date de création, données EXIF pour les photos (date de prise de vue, position si activée). Ensuite les motifs : un numéro de facture, un SIRET, une référence de chantier reconnus par expression régulière dans le texte. Enfin, seulement si nécessaire, un modèle qui lit la première page et renvoie une structure : type, émetteur, date, référence, indice de confiance.

L’OCR quand c’est un scan. Un PDF issu d’un scanner ne contient pas de texte. Tesseract en local suffit pour du document propre ; les modèles multimodaux font mieux sur les documents dégradés, au prix d’une sortie de données.

Le nommage. Un gabarit paramétrable, du type AAAA-MM-JJ_client_type_reference.ext. Trois règles qui évitent beaucoup d’ennuis : date en tête et au format ISO pour que le tri alphabétique soit chronologique ; pas d’accents ni d’espaces si les fichiers transitent entre Windows, Linux et des outils tiers ; longueur totale surveillée, Windows plafonnant historiquement les chemins à 260 caractères.

Les collisions. Deux fichiers qui produisent le même nom : on ne remplace jamais. Suffixe incrémental, et signalement si les contenus diffèrent — c’est souvent le symptôme d’un vrai problème en amont.

L’idempotence. Une empreinte SHA-256 du contenu est stockée. Le même fichier envoyé deux fois est reconnu et ignoré, ce qui évite les doublons quand quelqu’un renvoie « au cas où ».

Le journal. Chaque opération en base : empreinte, nom d’origine, destination, méthode d’identification, indice. C’est ce qui permet de revenir en arrière et de mesurer le taux d’erreur réel.

Questions fréquentes

Comment le système sait-il de quoi il s’agit ?
Par le contenu, pas par le nom. Une facture contient un numéro, une date, un émetteur, des montants ; un devis signé contient une signature et une référence ; une photo de chantier a des métadonnées de date et parfois de position. Le nom du fichier — souvent « IMG_4471.jpg » ou « scan0012.pdf » — est justement l’information la moins fiable.
Et les documents qu’il ne reconnaît pas ?
Ils vont dans un dossier « à classer », avec ce que le système a cru comprendre. Ils ne sont jamais rangés au hasard ni supprimés. En pratique ce dossier contient cinq à quinze pour cent des documents au démarrage, et se réduit à mesure qu’on ajoute les cas rencontrés.
Ça marche avec les photos prises sur le terrain ?
Oui, et c’est l’un des meilleurs usages. Une photo envoyée depuis un téléphone arrive avec sa date ; le chantier se déduit du message qui l’accompagne, de l’expéditeur ou de la position. Elle est renommée et rangée dans le dossier du client, datée. Le jour d’une contestation en fin de chantier, la différence entre un dossier photo daté et un téléphone plein est considérable.
Faut-il changer d’outil de stockage ?
Non. Un dossier réseau, un espace partagé en ligne, un logiciel métier : le flux dépose là où vous rangez déjà. Changer les habitudes de l’équipe est le meilleur moyen de faire échouer le projet.
Combien coûte l’automatisation du classement de documents ?
Entre 1 500 et 4 000 € selon le nombre de types de documents à reconnaître et la complexité de l’arborescence cible. C’est un chantier léger dont le gain est très inégalement réparti : négligeable dans une entreprise bien rangée, considérable dans celle où chacun cherche un contrat pendant dix minutes plusieurs fois par semaine.
Combien de temps pour le mettre en place ?
Deux à quatre semaines. La construction est rapide ; ce qui demande du temps, c’est de fixer la règle de nommage et l’arborescence avec les personnes qui s’en serviront. Une convention imposée sans eux est contournée en un mois, et l’on se retrouve avec deux systèmes de classement au lieu d’un.
Que deviennent les documents déjà accumulés ?
Ils peuvent être repris en une passe de rattrapage, chiffrée à part selon le volume. Nous conseillons toutefois de commencer par le flux courant et de ne reprendre l’historique qu’ensuite : cela permet de vérifier que la convention tient à l’usage avant de l’appliquer à trente mille fichiers.
Quel gain réel peut-on attendre ?
Le temps de recherche, qui est très sous-estimé parce qu’il se paie en tranches de trois minutes invisibles. Le relevé d’une semaine le révèle presque toujours : c’est l’une des tâches qui ressort systématiquement du chiffrage alors que personne ne l’avait citée en réunion. Le second gain, moins mesurable, est la fin des versions multiples d’un même document.

Pour aller plus loin

Ce process, chez vous

Les chiffres de cette page sont des ordres de grandeur observés. Les vôtres seront différents — et c’est précisément ce que l’audit mesure.

Parlons-en

Ce process, chez vous

Celui qui vous agace le plus, ou celui qui coûte le plus. Dites-nous en deux phrases qui le fait, combien de fois par semaine, et avec quels outils. Nous vous dirons franchement s’il mérite d’être automatisé — y compris quand la réponse est non.

  • Réponse garantie sous 24 heures
  • Un premier échange d’une demi-heure, sans engagement
  • Aucun formulaire tiers : votre message part par votre messagerie

Ou directement : nicolas@oli-via-net.fr· 06 89 96 40 79

Le message s’ouvrira dans votre messagerie, prêt à partir.