Votre CSV a des choses à vous dire.
Tabalyst profile chaque ligne, révèle la structure et les anomalies, puis livre un rapport HTML à explorer et un JSON prêt à réutiliser.
insurance-customers.csv
805,3 Ko · utf-8-sig · séparateur « , »
Informations sur la qualité (5)
Profil global- Lignes dupliquées8
- Cellules manquantes12 532
- Espaces internes normalisés129
- Colonnes de types mixtes6
Types de colonnes
Colonnes (6 / 34)
| Colonne | Manquant | Distinct | Type inféré | Sémantique |
|---|---|---|---|---|
| 1filiale | — | 3 | text | enum |
| 2id_client | — | 2 992 | text | — |
| 3civilite | — | 2 | text | enum |
| 4prenom | 0,23% 7 | 227 | text | — |
| 6date_naissance | 0,20% 6 | 2 889 | mixed | date |
| 26prime_annuelle | — | 2 975 | number | — |
Transformations (34)
Valeurs normalisées| Colonne | Manquant | Rogné | Espaces réduits | Distinct |
|---|---|---|---|---|
| 4prenom | 0,23% 7 | — | 0,20% 6 | 227 |
| 5nom | 0,13% 4 | — | 0,17% 5 | 214 |
| 14ville | — | — | 0,23% 7 | 135 |
| 20telephone | — | — | 1,40% 42 | 1 604 |
Le fichier source reste inchangé; ces transformations servent uniquement au profil statistique.
Analyse numérique (4)
Minimum · maximum · moyenne · médianeAnalyse des dates (6)
Formats détectés| Colonne | Statut | Valide | Ambigu | Invalide | Formats |
|---|---|---|---|---|---|
| date_naissance | mixed | 88,01% | 11,89% | 0,10% | 6 variantes |
| date_debut | mixed | 88,60% | 11,17% | 0,23% | 5 variantes |
| date_fin | mixed | 88,91% | 10,97% | 0,12% | 6 variantes |
| date_reclamation | mixed | 87,14% | 12,62% | 0,24% | 3 variantes |
Aperçu des données (20 lignes)
Valeurs brutes du CSV| # | filiale | id_client | civilite | prenom | nom | date_naissance | ville | province |
|---|---|---|---|---|---|---|---|---|
| 1 | principal | CLI-00000281 | Mme | Lucie | Roy | 1961-03-31 | Montréal | Québec |
| 2 | principal | CLI-00000432 | Mme | Suzanne | Taylor | 1983-01-14 | Lévis | Québec |
| 3 | principal | CLI-00000538 | Mme | Juliette | Michaud | 1941-09-10 | Granby | Québec |
| 4 | principal | CLI-0000072 | M. | Oliivier | Landry | 1936-12-13 | Repentigny | Québec |
Aperçu fidèle aux valeurs originales, avant normalisation.
Données réelles du rapport de démonstration · Cliquez sur la navigation pour explorer
Avant l’analyse
Un fichier simple.
Des risques bien cachés.
Ouvrir un CSV ne suffit pas à le qualifier. Tabalyst rend visibles les détails qui fragilisent une importation, une migration ou une analyse.
Les types ne sont pas ceux attendus
Une colonne numérique peut cacher du texte; une date peut être valide, impossible ou simplement ambiguë. Tabalyst sépare ces situations.
Le vide a plusieurs visages
Cellules vides, espaces invisibles, valeurs manquantes et lignes dupliquées sont comptés sur l’ensemble du fichier.
L’inspection manuelle ne se reproduit pas
Le profil JSON, la configuration effective et l’historique d’exécution laissent une trace vérifiable de chaque analyse.
Une chaîne claire
Du fichier brut à une vue exploitable.
L’analyse et la présentation sont séparées. Vous pouvez régénérer le rapport depuis le profil JSON sans relire le CSV.
Votre fichier source
Le contenu brut est lu localement. L’aperçu reste fidèle aux valeurs originales.
Analyse Tabalyst
Types, valeurs manquantes, doublons, dates, distributions et transformations sont profilés selon une configuration explicite.
Humain + machine
Un modèle validé pour vos outils; une interface interactive pour explorer et partager les constats.
Ce que vous voyez
Un profil précis, sans boîte noire.
Tabalyst décrit les données et expose ses calculs. Il ne modifie jamais silencieusement le fichier source.
Structure et qualité en un coup d’œil
Lignes, colonnes, cellules manquantes, doublons, colonnes constantes, valeurs distinctes et observations générales donnent une lecture immédiate de l’état du dataset.
Types avec niveau de confiance
Texte, entier, nombre, booléen, date, mixte ou vide — sans forcer une colonne réellement hétérogène.
Dates sans faux raccourcis
Formats multiples, dates ambiguës, invalides au calendrier et simples textes sont distingués clairement.
Normalisation mesurée, brut préservé
Espaces de début et de fin, tabulations et suites d’espaces peuvent être normalisés pour les statistiques. Chaque cellule modifiée est comptée; l’aperçu, lui, conserve la valeur source.
Échantillons reproductibles
Les distributions à forte cardinalité restent lisibles grâce à une sélection représentative et une graine configurable.
PS> python -m tabalyst analyze data.csv ` -o reports\data\report.html ✓ Analysis complete report.html report.json execution.json
{
"dataset": {
"rows": 3000,
"columns": 34,
"missing_cells": 12532
},
"profile_version": "…",
"columns": [ "…" ]
}Transparent par conception
Vos données restent sous votre contrôle.
Tabalyst s’exécute depuis votre terminal, sur votre machine. Aucun compte, aucun téléversement, aucune promesse de correction automatique.
- Le CSV n’est pas envoyé à un service Tabalyst.
- Les paramètres effectifs sont enregistrés avec le résultat.
- Le code est consultable et adaptable sous licence MIT.
- Le rapport contient des données du CSV et doit être protégé en conséquence.
Prêt à regarder de plus près?
Qualifiez votre prochain CSV avant de construire dessus.
Explorez le dépôt, lancez une première analyse et partagez vos retours pour accompagner le lancement.
La version actuelle est disponible en Alpha pour les tests. Tabalyst est en phase de lancement et continue d’évoluer grâce aux premiers retours.