App-Greple-xlate

 view release on metacpan or  search on metacpan

i18n/src/xlate.gpt5-FR.pod  view on Meta::CPAN

Les données au format marqueur de conflit peuvent être visualisées côte à côte avec la commande L<sdif|App::sdif> et l’option C<-V>. Comme il n’a pas de sens de comparer chaîne par chaîne, l’option C<--no-cdif> est recommandée. Si vous...

    sdif -V --no-filename --no-tc --no-cdif data_shishin.deepl-EN-US.cm

=for html <p>
<img width="750" src="https://raw.githubusercontent.com/kaz-utashiro/App-Greple-xlate/main/images/sdif-cm-view.png">
</p>

=head1 NORMALIZATION

Le traitement est effectué par unités spécifiées, mais dans le cas d’une séquence de plusieurs lignes de texte non vides, elles sont converties ensemble en une seule ligne. Cette opération est effectuée comme suit:

=over 2

=item *

Supprimer les espaces au début et à la fin de chaque ligne.

=item *

Si une ligne se termine par un signe de ponctuation pleine chasse, la concaténer avec la ligne suivante.

=item *

Si une ligne se termine par un caractère pleine chasse et que la ligne suivante commence par un caractère pleine chasse, concaténer les lignes.

=item *

Si soit la fin soit le début d’une ligne n’est pas un caractère pleine chasse, les concaténer en insérant un espace.

=back

Les données de cache sont gérées sur la base du texte normalisé, de sorte que même si des modifications sont apportées qui n’affectent pas les résultats de normalisation, les données de traduction mises en cache resteront efficaces.

Ce processus de normalisation est effectué uniquement pour le premier motif (0e) et les motifs de numéro pair. Ainsi, si deux motifs sont spécifiés comme suit, le texte correspondant au premier motif sera traité après normalisation, et aucun pr...

    greple -Mxlate -E normalized -E not-normalized

Par conséquent, utilisez le premier motif pour le texte devant être traité en combinant plusieurs lignes en une seule, et utilisez le second motif pour le texte préformaté. S’il n’y a pas de texte correspondant au premier motif, utilisez un ...

=head1 MASKING

Il arrive qu’il y ait des parties du texte que vous ne souhaitez pas traduire. Par exemple, des balises dans des fichiers Markdown. DeepL suggère que, dans de tels cas, la partie du texte à exclure soit convertie en balises XML, traduite, puis re...

    --xlate-setopt maskfile=MASKPATTERN

Cela interprétera chaque ligne du fichier C<MASKPATTERN> comme une expression régulière, traduira les chaînes qui y correspondent, puis reviendra en arrière après le traitement. Les lignes commençant par C<#> sont ignorées.

Un motif complexe peut être écrit sur plusieurs lignes avec un retour à la ligne échappé par une barre oblique inverse.

La manière dont le texte est transformé par le masquage peut être visualisée avec l’option B<--xlate-mask>.

Le masquage protège le balisage contre la traduction. Pour dissimuler les chaînes sensibles au service de traduction lui-même, voir L</ANONYMIZATION AND TEMPLATES> ; les deux peuvent être utilisés ensemble.

Cette interface est expérimentale et susceptible d’évoluer à l’avenir.

=head1 ANONYMIZATION AND TEMPLATES

Les chaînes sensibles peuvent être dissimulées avant d’être envoyées à l’API de traduction et restaurées dans la sortie. Trois sources de règles d’anonymisation sont disponibles : un fichier dictionnaire (B<--xlate-anonymize>), des marq...

Pour les documents de formulaire (rapports trimestriels et similaires), définissez les acteurs en amont et référencez-les dans le corps :

    ---
    報告者: 山田太郎
    発注会社: アクメ株式会社
    ---
    本件について {{ 報告者 }} が調査を行った。

Traduisez le modèle une fois par langue avec C<--xlate-template> (et C<--xlate-frontmatter> lorsque les valeurs sont conservées dans le fichier), puis générez chaque cas avec le mode autonome B<pandoc-embedz> -- les valeurs sous C<global:> dans u...

    greple -Mxlate --xlate --xlate-engine=gpt5 --xlate-to=EN-US \
           --xlate-template= --xlate-format=xtxt \
           --match-paragraph --all --need=0 \
           report-template.md > report-template.EN.md
    pandoc-embedz --standalone report-template.EN.md \
                  -c case-123.yaml -o report-123.EN.md < /dev/null

Pour les marques en ligne, fournir une configuration de définition de macros permet au même modèle traduit d’afficher soit les vrais noms, soit une version expurgée :

    # macros.yaml           # macros-redacted.yaml
    preamble: |             preamble: |
      {% macro person(name) %}{{ name }}{% endmacro %}
                              {% macro person(name) %}(関係者){% endmacro %}

Excluez les blocs embedz de la traduction lorsqu’un document en contient :

    --exclude '^```embedz\n(?s:.*?)^```\n'

=head1 OPTIONS

=over 7

=item B<--xlate>

=item B<--xlate-color>

=item B<--xlate-fold>

=item B<--xlate-fold-width>=I<n> (Default: 70)

Lancer le processus de traduction pour chaque zone correspondante.

Sans cette option, B<greple> se comporte comme une commande de recherche normale. Vous pouvez ainsi vérifier quelle partie du fichier sera traduite avant de lancer le travail effectif.

Le résultat de la commande est envoyé sur la sortie standard ; redirigez vers un fichier si nécessaire, ou envisagez d’utiliser le module L<App::Greple::update>.

L’option B<--xlate> appelle l’option B<--xlate-color> avec l’option B<--color=never>.

Avec l’option B<--xlate-fold>, le texte converti est replié à la largeur spécifiée. La largeur par défaut est 70 et peut être définie par l’option B<--xlate-fold-width>. Quatre colonnes sont réservées pour l’opération en début de lig...

=item B<--xlate-engine>=I<engine>

Spécifie le moteur de traduction à utiliser.

À ce stade, les moteurs suivants sont disponibles

=over 2

=item * B<gpt5>: gpt-5.5 (via the C<llm> command)

=item * B<deepl>: DeepL API (via the C<deepl> command)

=item * B<gpt3>: gpt-3.5-turbo (legacy, via the C<gpty> command)

=item * B<gpt4o>: gpt-4o-mini (legacy, via the C<gpty> command)

=back

Les modules de moteur sont d’abord recherchés dans les espaces de noms backend (C<llm>, puis C<gpty>), puis directement sous C<App::Greple::xlate>. Ainsi, C<gpt5> charge C<App::Greple::xlate::llm::gpt5>, qui appelle la commande C<llm>, tandis que ...

=item B<--xlate-labor>

=item B<--xlabor>

Au lieu d’appeler un moteur de traduction, il est attendu que vous travailliez manuellement. Après avoir préparé le texte à traduire, il est copié dans le presse-papiers. Vous devez le coller dans le formulaire, copier le résultat dans le pre...

=item B<--xlate-to> (Default: C<EN-US>)

Spécifiez la langue cible. Les moteurs LLM acceptent tout nom ou code de langue que le modèle comprend ; il est interpolé dans l’invite de traduction. Vous pouvez obtenir les langues disponibles via la commande C<deepl languages> lorsque vous ut...

=item B<--xlate-from> (Default: C<ORIGINAL>)

Étiquette utilisée pour le texte original dans les formats de sortie C<conflict>, C<colon> et C<ifdef>. Avec le moteur B<DeepL>, une valeur non par défaut est également transmise comme langue source.

=item B<--xlate-format>=I<format> (Default: C<conflict>)

Spécifiez le format de sortie pour le texte original et le texte traduit.

Les formats suivants autres que C<xtxt> supposent que la partie à traduire est un ensemble de lignes. En fait, il est possible de traduire seulement une portion de ligne, mais spécifier un format autre que C<xtxt> ne produira pas de résultats pert...

=over 4

=item B<conflict>, B<cm>

Le texte original et le texte converti sont imprimés au format des marqueurs de conflit L<git(1)>.

    <<<<<<< ORIGINAL
    original text
    =======
    translated Japanese text
    >>>>>>> JA

Vous pouvez récupérer le fichier original avec la commande suivante L<sed(1)>.

    sed -e '/^<<<<<<< /d' -e '/^=======$/,/^>>>>>>> /d'

=item B<colon>, I<:::::::>

Le texte original et le texte traduit sont sortis dans un style de conteneur personnalisé de Markdown.

    ::::::: ORIGINAL
    original text
    :::::::
    ::::::: JA
    translated Japanese text
    :::::::

Le texte ci-dessus sera traduit comme suit en HTML.

    <div class="ORIGINAL">
    original text
    </div>
    <div class="JA">
    translated Japanese text
    </div>

Le nombre de deux-points est 7 par défaut. Si vous spécifiez une séquence de deux-points comme C<:::::>, elle est utilisée à la place de 7 deux-points.

=item B<ifdef>

Le texte original et le texte converti sont imprimés au format L<cpp(1)> C<#ifdef>.

    #ifdef ORIGINAL
    original text
    #endif
    #ifdef JA
    translated Japanese text
    #endif

Vous pouvez récupérer uniquement le texte japonais avec la commande B<unifdef> :

    unifdef -UORIGINAL -DJA foo.ja.pm

=item B<space>

=item B<space+>

Le texte original et le texte converti sont imprimés séparés par une ligne blanche. Pour C<space+>, il ajoute également une nouvelle ligne après le texte converti.

=item B<xtxt>

Si le format est C<xtxt> (texte traduit) ou inconnu, seul le texte traduit est imprimé.

=back

=item B<--xlate-maxlen>=I<chars> (Default: 0)

Spécifiez la longueur maximale du texte à envoyer à l’API en une seule fois. La valeur par défaut 0 signifie la limite propre au moteur : pour le service de compte gratuit DeepL, elle est de 128K pour l’API (B<--xlate>) et de 5000 pour l’in...

=item B<--xlate-maxline>=I<n> (Default: 0)

Spécifiez le nombre maximal de lignes de texte à envoyer à l’API en une seule fois.

Définissez cette valeur à 1 si vous souhaitez traduire une ligne à la fois. Cette option a priorité sur l’option C<--xlate-maxlen>.

=item B<--xlate-prompt>=I<text>

Spécifiez une invite personnalisée à envoyer au moteur de traduction. Cette option est disponible pour les moteurs LLM (C<gpt3>, C<gpt4o>, C<gpt5>), mais pas pour DeepL. Vous pouvez personnaliser le comportement de traduction en fournissant des in...

=item B<--xlate-context>=I<text>

Spécifiez des informations de contexte supplémentaires à envoyer au moteur de traduction. Cette option peut être utilisée plusieurs fois pour fournir plusieurs chaînes de contexte. Les informations de contexte aident le moteur de traduction à ...

=item B<--xlate-context-window>=I<n>

(Context-aware engines only, e.g. C<gpt5> on the llm backend)
Nombre de blocs traduits environnants transmis comme contexte de référence lors de la retraduction de blocs modifiés (par défaut 2). Le contexte inclut également le texte source brut autour de la région modifiée (titres, structure de liste, lÃ...

=item B<--xlate-cache-seed>=I<file>

Initialisez le cache d’un nouveau document à partir du fichier de cache d’un autre document. Utile pour les rapports périodiques : amorcez le cache du nouveau numéro avec celui du numéro précédent, afin que les paragraphes inchangés ne soi...

=item B<--xlate-anonymize>=I<file>

Anonymisez les chaînes sensibles avant qu’elles ne soient envoyées à l’API de traduction, et restaurez-les dans la sortie. Le fichier de dictionnaire fournit une entrée par élément : en JSON (canonique, générable par machine)

    [ { "category": "person",  "text": "山田太郎" },
      { "category": "company", "regex": "アクメ(株式会社)?" } ]

ou dans un format simple par ligne (C<category pattern>, C</.../> pour les regex). Chaque élément est remplacé par une étiquette de catégorie telle que C<< <person id=1 /> >> ; la même chaîne reçoit toujours la même étiquette, de sorte que ...

Un dictionnaire peut être généré par un outil externe — par exemple un modèle local extrayant des entités sensibles :

    llm -m <local-model> \
        -s 'Extract sensitive entities as a JSON array of objects
            with "category" and "text" fields.' \
        < report.md > report.anon.json
    greple -Mxlate --xlate-anonymize=report.anon.json ...

Un BOM UTF-8 dans le fichier est toléré. Les valeurs dans le format de ligne de front matter peuvent porter un commentaire final uniquement sur leur propre ligne, pas après la valeur.

=item B<--xlate-anonymize-mark>[=I<regex>]

Collectez les entrées d’anonymisation à partir des marques inline dans le document lui-même. Marquez la première occurrence comme C<{{ person("山田太郎") }}> et chaque occurrence de la chaîne dans l’ensemble du document est anonymisée. ...

Notez qu’avec une option à valeur facultative comme celle-ci, un argument de fichier suivant serait pris comme valeur : écrivez C<--xlate-anonymize-mark=> (avec un C<=> final) lorsque vous utilisez la notation par défaut.

Des notations alternatives peuvent être configurées, par exemple C<< --xlate-anonymize-mark='@@(?<category>[a-z][a-z0-9_]*):(?<text>[^\n]+?)@@' >> pour des marques de style C<@@person:NAME@@>, ou une forme de commentaire HTML qui reste invisible da...

=item B<--xlate-template>[=I<regex>]

Traitez les expressions de modèle (par défaut : Jinja2 C<{{ ... }}>, C<{% ... %}>, C<{# ... #}>) comme des espaces réservés opaques : indiquez au modèle de les copier sans les modifier et vérifiez, pour chaque bloc, que la réponse contient exa...

Notez qu’avec une option à valeur facultative comme celle-ci, un argument de fichier suivant serait pris comme valeur : écrivez C<--xlate-template=> (avec un C<=> final) lorsque vous utilisez la notation par défaut.

=item B<--xlate-frontmatter>

Traitez un bloc initial C<---> ... C<---> comme un front matter YAML : excluez-le de la traduction et des tranches de contexte de phase 2, et ajoutez ses valeurs C<key: value> plates aux règles d’anonymisation (catégorie C<var>) comme filet de sÃ...

Laissez toujours une ligne vide après le C<---> de fermeture. Avec un motif de correspondance de style paragraphe, un front matter qui se poursuit directement dans le texte du corps forme un bloc chevauchant que l’exclusion ne peut pas supprimer (...

=item B<--xlate-glossary>=I<glossary>

Spécifiez un ID de glossaire à utiliser pour la traduction. Cette option n’est disponible qu’avec le moteur DeepL. L’ID de glossaire doit être obtenu depuis votre compte DeepL et garantit une traduction cohérente des termes spécifiques.

=item B<--xlate-dryrun>

N’appelez pas l’API de traduction ; affichez plutôt, via l’affichage de progression, chaque charge utile exactement telle qu’elle serait transmise (après anonymisation et masquage). Utile pour vérifier ce qui quitte la machine et pour esti...

=item B<-->[B<no->]B<xlate-progress> (Default: True)

Voir le résultat de la traduction en temps réel dans la sortie STDERR. La charge utile C<From> est affichée telle qu’elle est transmise, après anonymisation et masquage.

=item B<--xlate-stripe>

Utilisez le module L<App::Greple::stripe> pour afficher la partie correspondante avec un zébrage. Ceci est utile lorsque les parties correspondantes sont enchaînées dos à dos.

La palette de couleurs est basculée en fonction de la couleur de fond du terminal. Si vous souhaitez spécifier explicitement, vous pouvez utiliser B<--xlate-stripe-light> ou B<--xlate-stripe-dark>.

=item B<--xlate-mask>



( run in 1.744 second using v1.01-cache-2.11-cpan-14f38c9f855 )