PrepDataset — Préparer des datasets d'images côté client pour l'IA & la vision par ordinateur

Triez, organisez, séparez et nettoyez vos datasets d'images localement dans votre navigateur. Rapide, 100 % sécurisé, sans latence serveur et conforme au RGPD. Séparez vos dossiers d'entraînement/validation/test, renommez vos fichiers et trouvez les doublons sans envoyer vos images sur un serveur.

Commencer à trier les images Diviser un dataset existant

Outils de dataset côté client haute performance

  • Classificateur & trieur d'images

    Importez vos hiérarchies de dossiers, attribuez des catégories grâce à des raccourcis clavier rapides, suivez l'équilibre des classes et exportez directement des dossiers structurés.

  • Séparateur de dataset stratifié

    Divisez vos images en sous-ensembles Train, Validation et Test. Gère la stratification pour conserver automatiquement l'équilibre des classes dans chaque dossier.

  • Redimensionneur d'images & padding

    Redimensionnez, étirez ou complétez (letterbox) un lot d'images à des dimensions carrées uniformes nécessaires pour l'entraînement des modèles d'IA.

  • Détecteur de doublons pHash

    Détectez les images quasi-identiques grâce au hachage perceptuel (pHash) local pour améliorer la qualité de vos données et éviter le surapprentissage.

  • Renommer des lots d'images

    Renommez instantanément des centaines d'images selon des modèles prédéfinis, des catégories ou un index incrémental avec export immédiat.

  • Vérificateur d'images corrompues

    Scannez automatiquement vos fichiers pour détecter les formats cassés, les fichiers vides et les en-têtes illisibles avant de passer des heures à entraîner vos modèles.

Pourquoi préparer ses datasets localement côté client ?

Traditionnellement, la préparation de datasets de machine learning nécessitait de téléverser des gigaoctets de fichiers vers des serveurs cloud, risquant des fuites de propriété intellectuelle et introduisant de la latence. PrepDataset traite vos images directement dans le cache de votre navigateur grâce aux API HTML5 File et aux Web Workers. Vos données ne quittent jamais votre ordinateur local, garantissant la confidentialité et une vitesse maximale.

Comment ça marche en 3 étapes simples

  1. Choisir l'outil & charger un dossier : Sélectionnez un outil et déposez un dossier local. Tout le traitement se fait localement.
  2. Organiser & nettoyer : Classifiez avec des raccourcis clavier, séparez les données, redimensionnez, renommez ou filtrez les doublons.
  3. Exporter le ZIP : Téléchargez instantanément vos données organisées sous la forme d'une archive ZIP standard.

Questions fréquemment posées

Are my images uploaded to any server?

No. PrepDataset processes all images client-side. The files are read into local browser memory, processed, and zipped entirely on your machine. No server-side storage or uploads exist.

Qu'est-ce qu'un découpage de dataset stratifié ?

[translated indexHtml.faq2A] (falls back to English)

Pour quels modèles de vision par ordinateur cet outil est-il conçu ?

PrepDataset aide à préparer des datasets pour tout modèle d'IA/ML, y compris YOLO, PyTorch, TensorFlow, Keras, Hugging Face, OpenCV, CNNs et bien d'autres.