logo
  • Environnements
  • Entreprise
  • Tarifs
PersonalJul 28, 2025

Identifier les fichiers dupliqués dans les téléchargements

Wendong FanWendong Fan
Identify Duplicate Files in Downloads
Automate Everything with
AI Workforce on Desktop
Download Eigent

Trouver tous les fichiers en double dans votre dossier — sans en ouvrir un seul

La plupart des gens savent qu’ils ont des fichiers en double quelque part. Des copies du même PDF avec des noms légèrement différents, des images enregistrées deux fois depuis des sources différentes, des documents exportés puis réexportés au fil de mois d’itérations. Les trouver et les nettoyer manuellement signifie tout ouvrir, comparer les tailles et le contenu, et espérer ne pas supprimer accidentellement quelque chose d’important.

Eigent analyse votre dossier, identifie les doublons selon plusieurs critères de comparaison, et présente les résultats regroupés et clairement étiquetés — afin que vous puissiez décider ce qu’il faut conserver et ce qu’il faut supprimer.

1Identifier le dossier à analyser

Assurez-vous que le dossier que vous souhaitez analyser est accessible sur votre bureau ou dans votre répertoire Documents. Pour ce workflow, la cible est un dossier nommé mydocs dans le répertoire Documents. Vous pouvez adapter l’invite à n’importe quel chemin de dossier sur votre machine.

2Rédiger l’invite d’analyse

Dites à Eigent ce que vous voulez qu’il recherche :

J’ai un dossier nommé mydocs dans mon répertoire Documents. Veuillez l’analyser et identifier tous les fichiers qui sont des doublons exacts ou quasi identiques — y compris ceux dont le contenu, la taille de fichier ou le format sont identiques (même si les noms de fichiers ou les extensions diffèrent). Listez-les clairement, regroupés par similarité.

L’expression clé ici est « même si les noms de fichiers ou les extensions diffèrent » — cela permet de repérer les cas où le même fichier a été enregistré sous un autre nom, ou où un .jpg et un .jpeg sont la même image.

3Eigent analyse et compare

Eigent analyse le dossier à l’aide de plusieurs méthodes de comparaison :

  • Correspondance exacte du contenu : fichiers dont le contenu est identique octet par octet, quel que soit le nom du fichier
  • Correspondance de taille de fichier : fichiers de même taille (utile pour repérer rapidement de probables doublons)
  • Regroupement par format : identification des fichiers du même type et probablement en double sur la base d’une analyse du contenu

Pour les fichiers image, Eigent peut également utiliser le hachage perceptuel (perceptual hashing) pour détecter des images quasi identiques qui ont été réenregistrées avec des niveaux de compression légèrement différents.

4Examiner les résultats regroupés

Eigent renvoie une liste structurée de groupes de doublons. Chaque groupe affiche tous les fichiers qui semblent être des doublons, avec leurs chemins complets et les métadonnées pertinentes. Vous pouvez voir en un coup d’œil quels fichiers sont des copies et où ils se trouvent dans votre structure de dossiers.

5Décider quoi supprimer

Eigent identifie les doublons mais vous laisse la décision de suppression. Une fois la liste examinée, vous pouvez indiquer à Eigent lesquels supprimer :

Conservez le fichier le plus récemment modifié dans chaque groupe et déplacez les autres vers un dossier appelé "Duplicates for Review".

Supprimez tous les doublons de contenu exact mais conservez une copie de chaque fichier.

6Pourquoi c’est important

Le nettoyage des fichiers en double est l’une de ces tâches que tout le monde sait devoir faire mais que presque personne ne prend jamais le temps de faire. C’est fastidieux, risqué (on ne veut pas supprimer la mauvaise version) et difficile à réaliser systématiquement à la main. Eigent rend cela plus sûr en affichant tout pour examen avant toute action — et plus rapide en effectuant automatiquement le travail de comparaison.

7À essayer ensuite

Analysez tout mon dossier Téléchargements et identifiez tous les fichiers en double.

Trouvez toutes les images dupliquées dans ma bibliothèque Photos et montrez-moi lesquelles sont quasi identiques.

Après avoir nettoyé les doublons, affichez-moi les 10 plus gros fichiers restants dans ce dossier.

Déplacez tous les fichiers en double dans un dossier "Review" au lieu de les supprimer.

8Conseils pour de meilleurs résultats

  • Soyez précis sur ce qui compte comme doublon. « Même contenu » est différent de « même nom de fichier ». Précisez dans votre invite quels critères sont les plus importants pour votre cas d’usage.

  • Analysez un dossier à la fois. Pour les répertoires très volumineux contenant des dizaines de milliers de fichiers, commencez par un sous-dossier spécifique afin de valider les résultats avant d’analyser l’ensemble.

  • Demandez à Eigent de créer un rapport. Ajouter « enregistrez les résultats au format CSV » vous donne un historique persistant de ce qui a été trouvé, utile pour auditer le nettoyage plus tard.

Other use cases

Déclaration de TVA automatisée à partir de reçus et de factures

Déclaration de TVA automatisée à partir de reçus et de factures

Veuillez traiter tous les reçus et factures du dossier "VAT", y compris les photos, les PDF scannés et les factures numériques. Le résultat final doit inclure uniquement deux fichiers : (1) vat_return.xlsx — le fichier Excel doit contenir une ligne par reçu ou facture, lister tous les champs extraits, indiquer si chaque élément est éligible à la récupération de TVA, afficher le montant de TVA récupérable pour chaque élément éligible, inclure la raison d’exclusion pour les éléments non récupérables, signaler clairement les éléments nécessitant une vérification manuelle, et inclure une feuille récapitulative affichant le montant total de TVA récupérable. (2) vat_return.html — créer un fichier HTML autonome qui peut être ouvert directement et partagé avec l’équipe comptable. Le fichier HTML doit afficher tous les éléments de récupération de TVA, le montant de TVA récupérable pour chaque élément, les éléments exclus et les raisons de l’exclusion, les éléments nécessitant une vérification manuelle, ainsi que le montant total de TVA récupérable. Ne devinez aucune information incertaine.

Tâche à long horizon : GLM-5.1 vs GLM-5.2 sur Eigent

Tâche à long horizon : GLM-5.1 vs GLM-5.2 sur Eigent

Menez une recherche approfondie sur 26 entreprises de l'écosystème d'infrastructure IA — le fil conducteur principal le plus certain de toute la chaîne de valeur de l'IA. Couvrez ces 6 sous-secteurs (choisissez des entreprises représentatives dans chacun, des leaders à grande capitalisation jusqu'aux acteurs plus petits) : centre de données IA (infrastructure de calcul / déploiement) ; GPU / puces IA (silicium d'entraînement et d'inférence, ASIC, IP) ; serveurs, réseau et modules optiques (switches, NIC, interconnexions optiques) ; alimentation, refroidissement liquide et stockage d'énergie (alimentation électrique, thermique, gestion de l'énergie) ; cloud IA / plateforme de calcul (hyperscalers, clouds GPU, plateformes de location de calcul) ; écosystème de soutien (HBM / packaging avancé, fonderie, connecteurs et autres composants critiques). Pour chaque entreprise, recherchez : nom de l'entreprise, sous-secteur, siège / pays ; produits principaux et rôle spécifique dans la chaîne IA ; public ou privé (ticker + bourse si coté ; si privé, indiquer la dernière valorisation / levée de fonds) ; capitalisation boursière ou taille de la valorisation (utilisée pour le classement) ; positionnement et avantage concurrentiel dans l'écosystème (1 à 2 phrases) ; principaux clients / concurrents. Ordre : au sein de chaque sous-secteur, classez du plus grand au plus petit (par capitalisation boursière / valorisation). Structurez l'ensemble de manière descendante : de l'ensemble du paysage de l'écosystème matériel jusqu'à chaque entreprise individuelle. Exigences de sortie : générez d'abord un fichier de données structuré ai_infra_data.json — contenant les 26 entreprises avec les champs ci-dessus, les 6 classifications de sous-secteurs, un indicateur public/privé et une matrice de comparaison croisée entre entreprises (sous-secteur × dimensions clés). Générez ensuite un rapport HTML soigné à partir de ce JSON : incluez un paysage de l'écosystème / diagramme en couches, des sections par secteur, des cartes d'entreprises, un indicateur visuel clair pour public vs privé (étiquettes ou code couleur), un graphique de classement par capitalisation boursière et un tableau de comparaison triable/filtrable. Rendez le design professionnel, dense en informations et interactif. Vérifiez d'abord l'exactitude des données de recherche (statut de cotation, tickers, valorisations — utilisez les chiffres les plus récents et citez les sources), puis générez le rapport. Envoyez la tâche en mode single-agent.

Créer 10 jeux HTML5 du Nouvel An chinois avec Eigent

Créer 10 jeux HTML5 du Nouvel An chinois avec Eigent

Créez 10 jeux distincts et COMPLETS sur des thèmes liés au Nouvel An chinois 2026 (Cheval) en HTML, CSS et JS (sans bibliothèques). Les jeux doivent être amusants, originaux, soignés et adaptés aux mobiles. Incluez un système de score, une difficulté progressive, des boutons de redémarrage et des visuels fluides. Couvrez : arcade, puzzle, endless runner, réaction, stratégie, mémoire, 2 joueurs en local, idle, pixel art rétro et 1 jeu expérimental.

Automate everything with AI workforce on desktop
Download Eigent

Essayez Eigent dès aujourd’hui

Téléchargez l’application de bureau open source. Votre workforce IA, exécutée sur votre machine.

Télécharger Eigent
Eigent

Recevez les dernières mises à jour, tutoriels et versions sur l’automatisation de la workforce IA.

ProduitEigentEnvironnementsTarifsEntreprise
ExplorerSolutionsCas d’usageCompétencesPluginsBlogs
DéveloppeursDocumentationGitHubCAMEL-AIOpen Source FundPartenaire
TéléchargementPour open source
EntrepriseÀ propos de nousMarqueCarrièresConditions d’utilisationPolitique de confidentialitéSécurité et confiancePolitique relative aux cookiesPolitique de remboursement et d’essai

Tous droits réservés © 2026 EIGENT UK LTD

Nouvelle version d’Eigent 1.0 publiée !download