23 KiB
Référence des étapes et des scripts
Ce document décrit le workflow détaillé, les commandes disponibles et les parcours alternatifs.
Étapes
Utiliser `python -m copienator gui` ou `python -m copienator gui Interro` pour lancer un GUI qui suit automatiquement les étapes décrites ci-dessous.
Prétraitement de l'énoncé
Dans le dossier de l'évaluation, mettre les fichiers suivants de l'évaluation :
`enonce.pdf`, `enonce.tex`, `correction.tex`.
-
`python -m copienator statement Interro` or `python -m copienator statement Interro –restart`
À partir des trois fichiers précédents, se charge de détecter les labels des questions et leur contenu.
Les questions vont également être regroupées. Par la suite, quand des requêtes de corrections seront effectuées sur une question, seulement les énoncés des questions du groupe seront envoyés (et le corrigé de la question). Il faut donc que chaque groupe contienne si possible le contexte nécessaire pour comprendre la question.
Une fenêtre s'ouvre pour permettre d'éditer le résultat. Ne pas hésiter à faire des groupes plus gros que les groupes par défaut.
Après relecture le script génère :
- un fichier `labels` avec les labels des questions
- Un dossier `Text` avec le contenu textuel des questions, regroupées.
- Un dossier `Sol` avec le contenu textuel du corrigé, question par question.
- Un dossier `Text2`, qui compile un fichier `.tex` pour chaque question (utilisé pour compiler un rendu pdf du corrigé pour chaque question)
- Un dossier `Sol2`, qui compile un fichier `.tex` pour chaque correction de chaque question.
- Un dossier `Persp` avec des instruction de barème pour chaque question.
Éventuellement : vérifier et modifier les barèmes dans `Persp`.
- Alternative personnelle : `python -m copienator statement-personal Interro`
Ces deux commandes suivent la convention des scripts standardisés.
Leur import ne lance aucun traitement et les erreurs partielles sont
distinguées des échecs. Les réponses d'extraction mises en cache par
copienator statementet le fichierlabelssont publiés atomiquement.
Prétraitement des copies
Mettre les copies scannées au format pdf dans Interro.
python -m copienator copies rotate Interro(facultatif) Retourne tous les pdf de 180°, si la photocopie a été faite à l'envers.python -m copienator copies rename Interrochange le nom des copies enCopie{id}.pdf-
python -m copienator page-split InterroDécoupe des copies A3 en pages A4, en retirant les pages vides.
Pour chaque page double il est possible
- de garder les deux pages
- de ne garder qu'une des deux pages.
- de jeter les deux pages
- de déplacer la délimitation à droite/gauche
Fix issues with
python -m copienator page-split Interro14/Copies/Copie01.pdfLe PDF transformé est construit dans un dossier temporaire. La copie produite et la sauvegarde dans
Copies Originalessont ensuite installées avec rollback : une erreur conserve les deux versions précédentes. Une relance ciblée lit directement la sauvegarde originale sans la déplacer au préalable. python -m copienator crop-labels InterroDécoupe la partie gauche des copies, là où il devrait y avoir les labels des exercices/questions.python -m copienator crop-labels Interro --fullpageto use the full page always. Rerun on a single file withpython -m copienator crop-labels Interro/Copies/Copie01.pdfLes images et le fichier_schema.jsond'une copie sont remplacés ensemble. Fermer l'outil juste après la dernière validation ne peut donc plus interrompre un thread de sauvegarde en arrière-plan.
Labelisation et regroupement
Optional : Set proxy with export HTTPS_PROXY="http://10.0.0.1:3128"
python -m copienator labels Interro, avec éventuellement--overwriteFait des requêtes à Gemini pour identifier les labels des questions dans images générées à partir des parties gauches des copies. Une copie PDF ou une image précise deCutleftpeut également être ciblée. Plusieurs cibles de la même évaluation sont acceptées. Les parties d'une copie restent traitées séquentiellement afin de conserver les labels précédents comme contexte, tandis que les copies différentes sont traitées en parallèle. Chaque réponse JSON validée est écrite atomiquement. Une cible sans image correspondante produit le code de sortie 4.-
python -m copienator review-labels InterroPermet de vérifier visuellement les labels trouvés.
- Sous Linux et macOS, on peut faire
epour ouvrir le fichier .json et l'éditer a la main. - Quand un label est manquant, il est possible de cliquer sur l'image, ce qui copie les coordonnées dans le presse papier puis on peut l'ajouter à la main.
-
Utilisation de `_`, `|…` et `…|` :
- `|…` n'est pas arrêté verticalement par son type opposé.
- `…|` est stoppé horizontalement par le `|…` le plus proche.
Pour modifier une seule copie :
python -m copienator review-labels Interro/Copies/Copie01.pdfLes coordonnées agrégées sont écrites atomiquement dans le JSON de la copie. Fermer la fenêtre avant la fin d'une copie ne remplace pas son JSON par un résultat incomplet.
It also generates les
Copie01.json, à partir desCopie01_01.jsonEn cas de soucis, (par exemple les pages ne sont pas dans le bon ordre)- Réordonner les pages du fichier pdf
- Rerun
python -m copienator crop-labels Interro/Copie{id} - Rerun
python -m copienator labels Interro/Copie{id}
- Sous Linux et macOS, on peut faire
python -m copienator split-answers InterroDécoupe les copies suivant les exercices Peut-être appelé avec une seule copie. Les réponses d'une copie sont préparées dans un dossier temporaire, puis remplacent ensemble le dossier précédent. En cas d'erreur, l'ancienne version est conservée. Les réponses devenues obsolètes restent archivées dans le sous-dossierMissing.python -m copienator group-answers InterroRegroupe les mêmes questions de différentes copies en groupes de tailles raisonnables.- Facultatif :
python -m copienator verify-groups InterroVérifie que chaque réponse PDF apparaît bien dans les métadonnées des groupes. La commande renvoie un code non nul si une réponse est absente ou si la vérification est incomplète.
Correction et annotation
Optional : Set proxy with export HTTPS_PROXY="http://10.0.0.1:3128"
- Il faut créer des persp, pour indication de comment corriger, et
relancer
copienator statement-personal -
python -m copienator correct Interro --limit 240OUpython -m copienator correct Interro/Par\ label/Ex\ 2/Group_1.jpgOUpython -m copienator correct Interro --overwriteFais les requêtes de correction à Gemini.
copienator correctpeut être relancé sans supprimer son état. Les fichierscorrection.jsonetcorrection_progress.jsonsont mis à jour atomiquement. Avec--overwrite, leur version précédente reste en place jusqu'à la première écriture réussie de la nouvelle exécution.--resetest la seule option qui supprime explicitement cet état et restaure les fichiers*_old.pdf.L'argument
limitlimite le nombre de requêtes à Gemini Pro (chères), pour une version low cost, passer--limit 0, toutes les requêtes seront sur Gemini Flash.Pour diminuer le coût, il est possible de batch les requêtes, qui seront alors traitées sous au plus 24h.
python -m copienator correct Interro --batch- OU
python -m copienator correct Interro --batch-from 'Ex 4' python -m copienator batch-submit Interropython -m copienator batch-statuspython -m copienator batch-fetch Interropython -m copienator correct Interro --deal-with-batched
Les quatre commandes de ce flux suivent la convention des scripts standardisés. Les fichiers de requêtes et le résultat JSONL combiné sont publiés atomiquement : une interruption ne laisse pas de fichier final partiellement écrit.
copienator batch-submitconserve aussi les identifiants distants dansbatch_jobs.json; la récupération les utilise en priorité et garde la recherche par nom pour les anciens batchs.python -m copienator batch-status --download JOB --output resultat.jsonlpermet aussi de télécharger atomiquement le résultat d'un job particulier. -
python -m copienator post-correction Interro- Essaye de corriger des erreurs d'encodage/d'accents dans
correction.json. - aussi échappe les `_` en dehors du mode math, pour LaTeX.
- Essaye de corriger des erreurs d'encodage/d'accents dans
-
Résolution manuel de conflits, s'il y en a.
Edit `manual_resolutions.txt`. Use :
- `->` or `x>` : Here set a pipe `|` before or after the new_label name
- `-x` : replace the goal
- `ss` : do nothing
- `sx` : stay, and remove goal.
- `xx` : move to goal.
- `xs` : remove old, keep goal.
Then call `python -m copienator resolve-manual Interro`
- Call `python -m copienator correct Interro –refaire`.
Génération des copies annotées
python -m copienator annotate-simple Interro(facultatif) Ajoute les annotations Gemini aux copies, enregistrées dans le dossierAnot. On peut passer l'argument--overwrite.
OU
python -m copienator annotate-checks InterroAjoute les annotations Gemini, et des checkboxes à cocher. Enregistrées dans le dossierBnot,--overwriteUne seule copie peut être ciblée avec, par exemple,python -m copienator annotate-checks Interro/Copies/Copie01.pdf. Le mode--refaireexige un fichierrefaire.jsonet écrit dansBRnot.
OU
python -m copienator annotate-grouped InterrodansBGnotAjoute les annotations Gemini, et des checkboxes, et regroupe les réponses par question. Enregistrées dansBGnotNeeds : label_groups file (made automatically by this function), qui dit quelles questions regrouper.python -m copienator export Interro BGnot(gestion perso) Cela déplace les groupes dans le dossier configuré parEXPORT_DIR(par défautExport). Le second argument peut êtreBGnot,BnotouAnotet reste facultatif (BGnotpar défaut).AnotexporteConcat.jpg; les deux autres modes exportentConcat.pdf. Dans le GUI, seuls les dossiers présents sont proposés et le mode de la dernière génération d'annotations est présélectionné.
Il faut ensuite annoter les fichiers dans `EXPORT_DIR` avec une tablette graphique.
Lecture de la correction manuscrite
Before : vider le dossier configuré par IMPORT_DIR (par défaut
Import), puis y copier ou synchroniser les fichiers depuis la tablette.
python -m copienator import Interro BGnotUne fois les corrections manuelles appliquées aux fichiersConcat.pdf, il faut enregistrer le fichier annoté au même endroit, sous le nomConcat_annotated.pdf. Comme pour l'export, le second argument accepteBGnot,BnotouAnot. Le GUI présélectionne le dossier utilisé lors du dernier export. PourAnot, l'image est importée sous le nomConcat_annotated.jpg.python -m copienator read-annotations InterroLit lesConcat_annotateddansBnot, regénère les copies avec les modifications. Les fichiers générés (score.json,Concat.jpg, etc.) sont préparés séparément puis installés ensemble. Les entrées du dossierBnotrestent en place et une erreur de génération conserve les anciennes sorties.
OU
python -m copienator read-grouped InterroIdem, mais pourBGnot. Les tâches parallèles remontent leurs erreurs au processus principal au lieu de les ignorer.-
python -m copienator giving-names Interro BGnotCrée un dossier
A Rendreavec des liens symboliques vers- La copie à rendre
- un fichier
score.jsonqui contient les notes par question
Si un nom est
Unknown: renommer à la main le dossier et le fichier dedans. -
Éventuellement, faire des modifications manuelles aux
score.json.Puis
- `python -m copienator read-annotations –update-score Interro`
- `python -m copienator read-grouped –update-score Interro`
pour mettre à jour les scores dans les images.
-
(gestion perso)
gestion_classe nepour créer l'interro puisgestion_classe we(set barème here)python -m copienator update-ods Interrooupython -m copienator update-ods Interro --sum(en l'absence de barème)gestion_classe regestion_classe wsentpython -m copienator add-final-score Interro21(this makes files inServer/copies)
-
(gestion perso)
- Deploy
miqmacs-copies-assets, and - update the copies from
miqmacs.fr/admin.
- Deploy
- (gestion perso) Impression d'une copie. Via Evince » print to pdf.
Archivage et nettoyage
Une fois l'évaluation terminée, python -m copienator clean Interro
supprime les fichiers intermédiaires et régénérables. La commande ne
conserve que :
- les PDF
Copies/*.pdfproduits après le découpage des pages ; - les sources et sorties textuelles du prétraitement de l'énoncé :
enonce.tex,correction.tex,labels,label_groups,Text,Sol,Persp, les fichiers TeX deText2etSol2,CacheetTmp; - le résultat final
correction.json; - les journaux de
.copienator/logset les journaux placés à la racine, commecorrection_log; - les images et fichiers
score.jsonprésents dansA Rendre.
Les liens symboliques conservés dans A Rendre sont remplacés par de
véritables fichiers avant la suppression de leurs cibles. La commande
refuse de démarrer si les copies traitées, correction.json ou une
image/un score d'élève sont absents. Elle affiche d'abord un résumé et
demande de saisir le nom de l'évaluation pour confirmer.
Dans le GUI, cette commande apparaît comme dernière étape facultative
dans la section Archivage. Un avertissement rappelle que la
progression du GUI et les données binaires permettant de reprendre les
étapes seront définitivement perdues.
Utiliser python -m copienator clean Interro --dry-run pour afficher
le plan sans rien supprimer, et --yes pour omettre la confirmation
interactive.
Autres
Recorrection d'une copie ou de quelques questions
Dans le GUI, ouvrir la section Refaire des copies (facultatif),
repliée par défaut. Ajouter les copies et leurs questions depuis les
listes déroulantes, ou choisir Toute la copie, puis enregistrer la
sélection. Le dossier du passage principal est présélectionné d'après
le dernier mode utilisé et les dossiers présents ; vérifier ce choix.
Pour reprendre une même question dans toute la classe, choisir
Toutes les copies, sélectionner la question, puis + Ajouter.
Seules les copies ayant un PDF de réponse pour cette question (normal
ou _new) sont ajoutées ; le nombre de copies sans réponse est affiché.
Une copie déjà sélectionnée entièrement reste sélectionnée entièrement.
Les boutons Corrigés (Sol) et Consignes de notation (Persp) ouvrent
les dossiers des textes utilisés par la correction. Modifier et enregistrer
les fichiers des questions concernées avant de relancer Refaire la correction.
Ces boutons sont aussi disponibles dans le parcours principal.
Le choix PDF à vérifier propose Automatique, Par question (groupé)
ou Par copie. En automatique, une question présente dans plusieurs
copies déclenche le regroupement ; sinon les PDF sont produits par copie.
Les groupes sont limités en hauteur : une question pour toute la classe
peut donc produire quelques PDF plutôt qu'un fichier par élève.
Le GUI écrit refaire.json et guide ensuite le parcours ci-dessous.
La vérification du découpage, le redécoupage et la recorrection peuvent
être ignorés. Pour plusieurs copies, les vérifications et découpages
s'exécutent successivement ; un échec ou une interruption arrête la suite.
Ce parcours a sa propre progression : les boutons de navigation du
passage principal ne l'ouvrent pas automatiquement. Après la fusion,
les étapes de restitution déjà terminées sont marquées à revalider.
Pour enchaîner les reprises, deux boutons sont disponibles dans ce parcours :
Nouvelle reprisevide la sélection et remet les étapes de reprise à zéro.Refaire la même sélectionconserve les copies et les questions du dernier enregistrement, mais remet également les étapes de reprise à zéro.
Les choix du passage principal et de présentation des PDF sont conservés. Enregistrer ensuite la sélection avant de poursuivre.
Attention : appeler Nouvelle reprise seulement après avoir importé les
résultats et exécuté Mettre à jour les copies finales. La même précaution
s'applique à Refaire la même sélection. Un avertissement est affiché avant
les deux actions, avec une mention supplémentaire si la fusion n'est pas
marquée réussie. Annuler conserve la reprise actuelle. Après une fusion
réussie, utiliser ces boutons pour recommencer, plutôt que modifier la
sélection du passage terminé.
Chaque nouveau passage utilise Reprises/reprise-DATE-HEURE-ID/BRnot.
Le passage précédent garde ses PDF, ses retours manuscrits, sa sélection
et une copie de la progression du GUI. Au premier changement de passage,
l'ancien BRnot à la racine est également copié dans Reprises.
Ces archives concernent les fichiers de vérification, pas un mécanisme
permettant d'annuler les modifications des copies finales.
Le fichier refaire-session.json désigne le passage actif ; les commandes
habituelles --refaire le suivent automatiquement. Sans ce fichier, le
fonctionnement historique dans BRnot à la racine reste disponible.
Dans la suite, BRnot désigne le dossier de la reprise active.
L'export d'un passage identifié utilise son propre sous-dossier dans
EXPORT_DIR/Évaluation et préfixe les noms des PDF par son identifiant.
Conserver les noms complets au retour et placer les PDF directement dans
IMPORT_DIR. L'import ignore les retours des autres passages ; aucun retour
du passage actif donne un résultat partiel. Ainsi, deux reprises de la même
question ne partagent pas les mêmes noms de fichiers exportés.
Ce flux fonctionne après annotate-grouped (BGnot),
annotate-checks (Bnot) ou annotate-simple (Anot).
Terminer d'abord la lecture des annotations du passage principal
(read-grouped ou read-annotations pour les modes à cases).
Conserver les dossiers d'annotation et leurs fichiers de référence.
-
Si nécessaire, reprendre le découpage :
python -m copienator review-labels Interro/Copies/Copie01.pdfpython -m copienator split-answers Interro/Copies/Copie01.pdf
Vérifier les réponses découpées avant de relancer la correction, notamment les fichiers
_newet_oldissus de résolutions manuelles. -
Créer
Interro/refaire.json:[["Copie02", []], ["Copie01", ["Ex 1 : 1)"]]]
Une liste vide sélectionne toute la copie ; sinon donner les labels exacts des questions (pas seulement le nom de l'exercice).
python -m copienator correct Interro --refaireCrée des groupes individuels et remplace les corrections sélectionnées. Les anciennes corrections sont conservées dansoverwritten_correction.json. Cette étape peut être omise si les corrections sont modifiées à la main.-
Générer les PDF de vérification, selon la présentation souhaitée :
- Par question :
python -m copienator annotate-grouped Interro --refaire --overwrite - Par copie :
python -m copienator annotate-checks Interro --refaire --overwrite
Les deux commandes produisent uniquement les réponses sélectionnées dans
BRnot, avec des cases à cocher, quel que soit le mode du passage principal. Le mode groupé garde les identifiants des élèves et regroupe les réponses par label sans demander de modifierlabel_groups. Cela ne nécessite pas d'avoir généréBnotouBGnotauparavant. Attention :--overwriteremplace le contenu duBRnotactif, y compris ses annotations manuscrites, mais pas les autres reprises. Une génération incomplète conserve l'ancienBRnot. Sans--overwrite, unBRnotexistant est refusé. - Par question :
- Vider les dossiers personnels d'export/import des anciens fichiers,
puis
python -m copienator export Interro --refaire. Annoter les PDF sur la tablette, puis placer les PDF retournés dansIMPORT_DIRen conservant leur nom exporté (nom de groupe ouCopie01.pdf). Même sans modification manuscrite, retourner le PDF pour valider ce passage. python -m copienator import Interro --refaire-
Fusionner dans le dossier du passage principal :
- Groupé :
python -m copienator read-grouped Interro --refaire - Cases :
python -m copienator read-grouped Interro --refaire --annotation-dir Bnot - Simple :
python -m copienator read-grouped Interro --refaire --annotation-dir Anot
Le lecteur reconnaît les retours par question comme les retours par copie grâce aux métadonnées et réattribue les cases et notes à chaque élève. Un groupe manquant laisse intactes les copies qui en dépendent. Il reconstruit la copie complète, conserve les réponses non sélectionnées et leurs scores, et remplace les réponses sélectionnées par celles de
BRnot. Dans la compilation filtrée, les images déjà enregistrées des questions non sélectionnées sont conservées par prudence, même si leur score est parfait, pour ne pas perdre de notes. Les anciennes cases et notes manuscrites des questions refaites sont remplacées. Les autres copies restent intactes. En mode simple, une imageConcat_annotated.jpgou.jpegimportée doit conserver les dimensions de l'image exportée ; les parties non sélectionnées sont conservées. Le fichierrefaire_simple_layout.jsonmémorise le découpage de cette image pour les passages suivants.Les sorties finales (
Concat.jpg, images par question,score.jsonet compilation filtrée) sont mises à jour dansBGnot,BnotouAnot; les PDF et références du passage principal restent ceux de ce passage. Pour une nouvelle retouche, reprendre ce flux--refaire, sans relire ensuite les anciennes annotations avec le lecteur normal. Relancer ensuite les étapes habituelles de calcul des notes et de diffusion.refaire.json,BRnotet le dossier du passage principal sont obligatoires (code de sortie 3 s'ils manquent). Une copie dont les fichiers de retour sont incomplets est laissée intacte (code 4). Ne pas ajouter--update-scoresauf pour imposer volontairement les anciens scores, y compris ceux des questions refaites. - Groupé :