💧 Plouf Réserver un échange

Rapprocher et dédoublonner des fichiers

Deux listes qui décrivent les mêmes choses sans jamais les nommer pareil. L'application les rapproche, repère les doublons et produit une base unique sur laquelle on peut compter.

Aucun identifiant commun, des libellés saisis à la main, des variantes d'orthographe : c'est le travail que RECHERCHEV ne sait pas faire, et celui qu'on finit par faire à l'œil, ligne par ligne.

exemple d'application livrée — données fictives

Source A

4820 lignes

Source B

1290 lignes

Source C

763 lignes

Source D

2044 lignes

Base unique

1 412 doublons fusionnés

Rénovation du groupe scolaire

A · C

Réseau de chaleur — phase 2

B · D

Aménagement des berges

A

Extension de la médiathèque

A · B · D

Le rapprochement à l'œil

Pour une administration, quatre dispositifs décrivaient les mêmes projets de territoire. Aucun ne partageait d'identifiant avec les autres, et le même projet pouvait apparaître dans les quatre sous quatre noms différents.

  1. 1 Ouvrir les quatre fichiers côte à côte
  2. 2 Trier chacun par nom de porteur
  3. 3 Repérer à l'œil les intitulés qui se ressemblent
  4. 4 Vérifier le montant et la commune pour confirmer
  5. 5 Choisir laquelle des quatre lignes fait référence
  6. 6 Reporter la fusion, et recommencer à la ligne suivante

Sur quelques centaines de lignes, c'est fastidieux. Sur plusieurs milliers, c'est infaisable — et surtout impossible à refaire à l'identique le trimestre suivant.

Ce que fait l'application.

Rapprocher sans identifiant commun

L'application compare ce qui est comparable — nom, adresse, montant, date, commune — et calcule un degré de ressemblance plutôt que d'exiger une égalité stricte.

Tolérer les fautes de saisie

Accents, abréviations, majuscules, inversion nom-prénom, « Ste » pour « Sainte » : autant de différences qui bloquent une RECHERCHEV et que l'application absorbe.

Décider quoi garder

Quand deux lignes se rejoignent, il faut trancher : quelle source fait foi pour chaque champ. Cette règle est définie avec vous, une fois, et appliquée ensuite systématiquement.

Laisser le doute au doute

Les rapprochements certains sont appliqués, les cas limites sont mis de côté pour arbitrage humain. Une machine qui tranche toute seule sur un cas douteux crée des erreurs invisibles.

Expliquer chaque fusion

Pour chaque ligne fusionnée, on peut remonter aux lignes d'origine et à la raison du rapprochement. Sans cette traçabilité, personne n'accepte le résultat.

Refaire à l'identique

Le trimestre suivant, on redépose les fichiers et les mêmes règles s'appliquent. Le travail d'arbitrage déjà fait n'est pas à refaire.

Pourquoi pas une RECHERCHEV ?

RECHERCHEV et son successeur RECHERCHEX sont parfaits quand une clé commune existe. Le problème commence exactement là où elle n'existe pas.

RECHERCHEV Un tri à l'œil Une application Plouf
Sans identifiant commun Ne fonctionne pas Fonctionne, lentement Rapproche par ressemblance
Fautes de frappe et variantes Renvoie #N/A Repérées, si on est attentif Absorbées
Volume traitable Quelques milliers, si les clés sont propres Quelques centaines Des centaines de milliers
Cas douteux Silencieusement ignorés Tranchés selon la fatigue Isolés pour arbitrage
Traçabilité Aucune Aucune Chaque fusion est justifiée
Refaire le trimestre suivant Tout est à recommencer Tout est à recommencer On redépose les fichiers

Si vos deux fichiers partagent un identifiant fiable, restez sur une RECHERCHEV : c'est immédiat et gratuit.

Comment on s'y prend.

01

On regarde ce qui distingue vraiment deux lignes

Cette conversation est le cœur du projet. Deux projets au même endroit et au même montant sont-ils le même projet ? Vous seul le savez, et la réponse dépend de votre métier.

02

On calibre sur un échantillon que vous connaissez

On applique les règles à un lot dont vous connaissez déjà la bonne réponse, et on mesure : combien de rapprochements manqués, combien de faux positifs.

03

On règle le curseur ensemble

Rapprocher trop crée des fusions abusives, rapprocher trop peu laisse des doublons. Le bon réglage dépend de ce qui vous coûte le plus cher — et ce n'est pas la même réponse partout.

04

Vous arbitrez ce qui reste

L'application vous présente les cas limites, avec les lignes d'origine côte à côte. Vos arbitrages sont mémorisés et ne vous seront pas redemandés.

Questions fréquentes

Est-ce que l'application peut se tromper ? +

Oui, comme un humain sur cette tâche — mais de façon mesurable, ce qui change tout. Nous chiffrons le taux d'erreur sur un échantillon dont vous connaissez la réponse, et vous décidez du réglage en connaissance de cause plutôt qu'à l'aveugle.

Combien de fichiers peut-on rapprocher en même temps ? +

Il n'y a pas de limite pratique : nous avons traité quatre sources simultanément. Au-delà de deux, la vraie difficulté n'est pas technique mais de décider quelle source fait foi pour chaque information.

Est-ce que c'est de l'intelligence artificielle ? +

En partie, et seulement là où elle sert. La comparaison de textes proches relève d'algorithmes bien établis, pas d'IA. Nous n'ajoutons un modèle que pour les cas où la ressemblance ne suffit pas — par exemple comprendre que deux descriptions différentes désignent la même chose.

Que deviennent les lignes non rapprochées ? +

Elles sont conservées telles quelles et signalées comme uniques. Rien n'est supprimé : une ligne sans correspondance est peut-être un doublon manqué, mais c'est bien plus souvent un cas réellement isolé.

Peut-on relancer le traitement sur des données mises à jour ? +

Oui, c'est même l'usage principal après le premier chantier. Vous redéposez les fichiers, les règles et vos arbitrages passés s'appliquent, et seuls les nouveaux cas limites vous sont soumis.

Nos fichiers contiennent des données personnelles. +

Le traitement peut tourner entièrement sur vos machines, sans que rien ne sorte de votre réseau. C'est le mode que nous recommandons dès que des données personnelles sont en jeu.

Montrez-nous votre tableur.

Une demi-heure ensemble sur le fichier que vous utilisez vraiment, et vous saurez ce qui peut être automatisé. Sans engagement.

Prenez un créneau

  • Trente minutes, en visio
  • Nous regardons votre fichier ensemble
  • Vous repartez avec un avis, même si nous ne travaillons pas ensemble

Ou écrivez-nous

Ouvre votre messagerie, déjà remplie. Rien n'est envoyé sans vous.

Voir aussi

Automatiser un fichier Excel

Vous déposez l'export de votre logiciel métier, l'application renvoie le fichier fini : trié, filtré, mis en forme, prêt à envoyer. Sans macro et sans VBA à maintenir.

Une application branchée sur votre logiciel métier

Votre logiciel métier contient déjà tout. Nous construisons l'application qui en tire ce qu'il ne sait pas montrer : vos chantiers, vos marges, votre production, à jour en permanence.

Générer vos documents automatiquement

Vos données remplissent vos documents à votre place : mémoires techniques, bordereaux, notes de synthèse, fiches de référence. Mis en forme, à jour, produits en série.

Toutes les réalisations →