Développeur / Données
Découper un CSV : lignes par fichier ou nombre de fichiers
Découpez un grand CSV UTF-8 en fichiers plus petits selon le nombre de lignes ou de fichiers souhaité. Conservez l’en-tête dans chaque fichier et téléchargez les résultats réunis dans un ZIP.
Découper un CSV : lignes par fichier ou nombre de fichiers: Lit le CSV par blocs et préserve les enregistrements entre guillemets contenant des virgules ou des retours à la ligne. Le mode « lignes par fichier » crée des parties consécutives ; le mode « nombre de fichiers » répartit les lignes de données entre des fichiers non vides. Le premier enregistrement peut être répété comme en-tête. Les fins d’enregistrement sont écrites au format CRLF. Le ZIP est généré sans compression. Les limites sont de 1 GiB pour l’entrée, 16 MiB par enregistrement et 1 000 fichiers de sortie. Fonctionne 100 % localement dans votre navigateur, sans aucun téléversement de fichier vers le serveur.
- Catégorie
- Outils développeur
- Exécutions
- Dans votre navigateur
- Coût
- Gratuit · sans inscription
- Disponibilité
- Prêt à l'emploi
Fonctionne entièrement dans votre navigateur
Les champs entre guillemets peuvent contenir des virgules et des sauts de ligne. Les enregistrements vides sont conservés. Les fins d’enregistrement sont écrites au format CRLF ; le texte entre guillemets reste inchangé. Le mode de nombre de fichiers effectue deux passes et équilibre le nombre de lignes ; s’il y a moins d’enregistrements que de fichiers demandés, moins de fichiers non vides sont produits.
Les fichiers sont lus par blocs. Les fichiers de sortie et le ZIP nécessitent malgré tout de la mémoire du navigateur. Limites : 1 GiB en entrée, 16 MiB par enregistrement et 1 000 fichiers de sortie. Les entrées du ZIP sont stockées sans compression.
Enregistrements CSV
La RFC 4180 documente le guillemetage CSV, les sauts de ligne intégrés et les en-têtes facultatifs (https://www.rfc-editor.org/rfc/rfc4180). Le séparateur compte les enregistrements logiques plutôt que les lignes physiques.
ZIP et fichiers locaux
PKWARE publie la spécification du format ZIP (https://support.pkware.com/pkzip/appnote). La sortie utilise des entrées ZIP stockées avec des sommes de contrôle CRC-32. La W3C File API (https://www.w3.org/TR/FileAPI/) décrit la gestion des fichiers locaux et des objets Blob. Vos données restent sur votre appareil.
Comment l'utiliser
- Choisissez un fichier CSV UTF-8 et une méthode de découpage.
- Définissez le nombre de lignes ou de fichiers, puis indiquez si le premier enregistrement est un en-tête.
- Découpez le fichier, vérifiez le nombre de lignes et téléchargez le ZIP.
Confidentialité et limitations
Vos entrées et vos fichiers sont traités dans votre navigateur. Rien n’est téléversé.
Outils associés
Questions fréquentes
Un retour à la ligne entre guillemets compte-t-il comme une ligne ?
Non. Un retour à la ligne dans un champ entre guillemets appartient à ce champ. Seules les limites d’enregistrement situées en dehors des champs entre guillemets comptent comme des lignes.
Les fichiers sont-ils équilibrés lorsque je choisis un nombre de fichiers ?
Oui. Dix enregistrements de données répartis dans trois fichiers donnent 4, 3 et 3 enregistrements. S’il y a moins d’enregistrements que de fichiers demandés, seuls des fichiers non vides sont créés.
Les enregistrements vides sont-ils conservés ?
Oui. Les enregistrements vides sont comptés et conservés. L’en-tête facultatif est le premier enregistrement, même s’il est vide.
L’intégralité du fichier est-elle chargée dans une zone de texte ?
Non. L’entrée est lue par blocs et le mode « nombre de fichiers » effectue deux passes. Les fichiers de sortie occupent toutefois la mémoire du navigateur ; la mémoire disponible peut donc limiter les téléchargements volumineux.
Outil gratuit · dans votre navigateur exécutions · aucun compte requis