Aller au contenu

Mappeur CSV

À quoi ça sert

Convertit un bordereau SEDA en fichier CSV, selon un mapping de colonnes que vous définissez vous-même — utile pour reprendre les données d'un bordereau dans un tableur, un outil métier, ou tout système attendant du CSV avec sa propre structure de colonnes.

Entrée

  • Un bordereau SEDA XML (2.1 ou 2.2), sous l'une de ces deux formes :

    • un bordereau standard (racine ArchiveTransfer) ;
    • un export Description.xml d'Asalae (racine Archive) — détecté automatiquement, aucune manipulation nécessaire de votre part.

    Tout autre fichier est rejeté avec un message explicite plutôt que de produire un CSV incomplet. - Un CSV de référence, dont seules les colonnes (en-têtes) sont utilisées — pour caler le résultat sur la structure attendue par votre outil de destination.

Mapping des colonnes

Une fois le CSV de référence déposé, chaque colonne détectée est associée à une variable cible — une liste déroulante — que vous choisissez vous-même. Cette liste n'est pas arbitraire : chaque entrée correspond à un champ précis du bordereau SEDA source (identifié par son chemin XPath dans le fichier XML), et c'est la valeur de ce champ qui est recopiée dans le CSV généré, unité d'archives par unité d'archives.

Une détection automatique pré-sélectionne une variable cible dès que le nom de la colonne du CSV de référence contient un mot-clé reconnu (ex. une colonne « Cote » ou « Archive Unit » présélectionne Cote (identifiant donné par le SAE), une colonne « Titre » présélectionne Intitulé, etc.) — elle reste modifiable manuellement dans chaque menu déroulant avant génération.

Variable cible (liste déroulante) Champ SEDA source Notes
Niveau hiérarchique — Calculé : profondeur de l'unité d'archives dans l'arborescence (0 = racine).
Intitulé Content/Title
Description / Analyse Content/Description
Date de début Content/StartDate Seule l'année (4 premiers caractères) est extraite.
Date de fin Content/EndDate Seule l'année (4 premiers caractères) est extraite.
Plage de dates (début-fin) Content/StartDate et Content/EndDate Combine automatiquement les deux (ex. 1990-2005), ou n'utilise que l'une des deux si l'autre est absente.
Cote (identifiant donné par le SAE) Content/ArchivalAgencyArchiveUnitIdentifier Cote attribuée par le service d'archives.
Localisation physique Content/ArchivalAgencyArchiveUnitIdentifier Même champ SEDA que « Cote » ci-dessus — les deux variables existent pour des besoins d'appellation différents côté CSV, mais pointent vers la même donnée source.
Lieu géographique Content/Keyword[KeywordType='geogname']/KeywordContent Tous les mots-clés géographiques, séparés par une virgule.
Mot matière Content/Keyword[KeywordType='subject']/KeywordContent Tous les mots-clés sujet, séparés par une virgule.
Service producteur Content/OriginatingAgency/Identifier
Communicabilité Management/AccessRule/Rule
Délai communicabilité Management/AppraisalRule/Rule Délai de durée d'utilité administrative (DUA).
Sort final Management/AppraisalRule/FinalAction

Une colonne du CSV peut aussi rester non mappée : elle est alors ignorée dans le résultat.

Champ non exposé dans l'interface

Le champ SEDA Content/OriginatingSystemId (identifiant du système d'origine) est géré côté outil mais n'apparaît pas encore dans la liste des variables cibles — il n'est donc pas mappable pour le moment.

Version du SEDA

SEDA 2.1 ou SEDA 2.2 — doit correspondre à la version réelle du bordereau source.

Déroulé du traitement

  1. Téléversement du bordereau SEDA et du CSV de référence.
  2. Les en-têtes de colonnes du CSV sont détectées automatiquement (séparateur ; ou ,).
  3. Association de chaque colonne à un champ SEDA (ou aucun).
  4. Génération du CSV : une ligne par unité d'archives, colonnes dans l'ordre du CSV de référence.
  5. Le fichier CSV est proposé au téléchargement, avec le nombre de lignes générées.

Purge quotidienne

Les fichiers téléversés et générés sont supprimés une fois par jour.