App-Greple-xlate

 view release on metacpan or  search on metacpan

i18n/src/xlate.deepl-ES.pod  view on Meta::CPAN

Si desea traducir todo el texto, utilice la opción B<--match-all>. Es un atajo para especificar el patrón C<(?s).+> que coincide con todo el texto.

Los datos en formato de marcador de conflicto pueden visualizarse en estilo lado a lado mediante el comando L<sdif|App::sdif> con la opción C<-V>. Dado que no tiene sentido comparar cadena por cadena, se recomienda la opción C<--no-cdif>. Si no nec...

    sdif -V --no-filename --no-tc --no-cdif data_shishin.deepl-EN-US.cm

=for html <p>
<img width="750" src="https://raw.githubusercontent.com/kaz-utashiro/App-Greple-xlate/main/images/sdif-cm-view.png">
</p>

=head1 NORMALIZATION

El procesamiento se realiza en unidades especificadas, pero en el caso de una secuencia de varias líneas de texto no vacías, se convierten juntas en una sola línea. Esta operación se realiza del siguiente modo:

=over 2

=item *

Se eliminan los espacios en blanco al principio y al final de cada línea.

=item *

Si una línea termina con un carácter de puntuación de ancho completo, concaténela con la línea siguiente.

=item *

Si una línea termina con un carácter de ancho completo y la línea siguiente comienza con un carácter de ancho completo, concatene las líneas.

=item *

Si el final o el principio de una línea no es un carácter de ancho completo, concaténelas insertando un carácter de espacio.

=back

Los datos de la caché se gestionan en función del texto normalizado, por lo que aunque se realicen modificaciones que no afecten a los resultados de la normalización, los datos de traducción almacenados en la caché seguirán siendo efectivos.

Este proceso de normalización sólo se realiza para el primer patrón (0) y los patrones pares. Por lo tanto, si se especifican dos patrones como los siguientes, el texto que coincida con el primer patrón se procesará después de la normalización...

    greple -Mxlate -E normalized -E not-normalized

Por lo tanto, utilice el primer patrón para texto que deba procesarse combinando varias líneas en una sola, y utilice el segundo patrón para texto preformateado. Si no hay texto que coincidir en el primer patrón, utilice un patrón que no coincid...

=head1 MASKING

En ocasiones, hay partes del texto que no desea traducir. Por ejemplo, las etiquetas de los archivos markdown. DeepL sugiere que, en tales casos, la parte del texto que debe excluirse se convierta en etiquetas XML, se traduzca y, una vez finalizada l...

    --xlate-setopt maskfile=MASKPATTERN

Esto interpretará cada línea del archivo C<MASKPATTERN> como una expresión regular, traducirá las cadenas que coincidan con ella y revertirá después del procesamiento. Las líneas que comienzan con C<#> se ignoran.

Los patrones complejos pueden escribirse en varias líneas con saltos de línea escapados mediante la barra invertida.

Cómo se transforma el texto mediante el enmascaramiento puede verse con la opción B<--xlate-mask>.

El enmascaramiento evita que se traduzcan los elementos de marcado. Para ocultar cadenas sensibles al propio servicio de traducción, consulta L</ANONYMIZATION AND TEMPLATES>; ambas opciones pueden utilizarse conjuntamente.

Esta interfaz es experimental y está sujeta a cambios en el futuro.

=head1 ANONYMIZATION AND TEMPLATES

Las cadenas sensibles pueden ocultarse antes de enviarlas a la API de traducción y restaurarse en el resultado. Hay tres fuentes de reglas de anonimización disponibles: un archivo de diccionario (B<--xlate-anonymize>), marcas en línea en el propio...

Para los documentos de formulario (informes trimestrales y similares), define los actores desde el principio y haz referencia a ellos en el cuerpo:

    ---
    報告者: 山田太郎
    発注会社: アクメ株式会社
    ---
    本件について {{ 報告者 }} が調査を行った。

Traduce la plantilla una vez por idioma con C<--xlate-template> (y C<--xlate-frontmatter> cuando los valores se mantengan en el archivo); a continuación, genera cada caso con B<pandoc-embedz> en modo autónomo; los valores bajo C<global:> en una con...

    greple -Mxlate --xlate --xlate-engine=gpt5 --xlate-to=EN-US \
           --xlate-template= --xlate-format=xtxt \
           --match-paragraph --all --need=0 \
           report-template.md > report-template.EN.md
    pandoc-embedz --standalone report-template.EN.md \
                  -c case-123.yaml -o report-123.EN.md < /dev/null

En el caso de las marcas en línea, proporcionar una configuración de definición de macro hace que la misma plantilla traducida muestre los nombres reales o una versión censurada:

    # macros.yaml           # macros-redacted.yaml
    preamble: |             preamble: |
      {% macro person(name) %}{{ name }}{% endmacro %}
                              {% macro person(name) %}(関係者){% endmacro %}

Excluye los bloques «embedz» de la traducción cuando un documento los contenga:

    --exclude '^```embedz\n(?s:.*?)^```\n'

=head1 OPTIONS

=over 7

=item B<--xlate>

=item B<--xlate-color>

=item B<--xlate-fold>

=item B<--xlate-fold-width>=I<n> (Default: 70)

Invoca el proceso de traducción para cada área coincidente.

Sin esta opción, B<greple> se comporta como un comando de búsqueda normal. Por lo tanto, puede comprobar qué parte del archivo será objeto de la traducción antes de invocar el trabajo real.

El resultado del comando va a la salida estándar, así que rediríjalo al archivo si es necesario, o considere usar el módulo L<App::Greple::update>.

La opción B<--xlate> llama a la opción B<--xlate-color> con la opción B<--color=nunca>.

Con la opción B<--xlate-fold>, el texto convertido se dobla por el ancho especificado. La anchura por defecto es 70 y puede ajustarse con la opción B<--xlate-fold-width>. Se reservan cuatro columnas para la operación de repliegue, por lo que cada ...

=item B<--xlate-engine>=I<engine>

Especifica el motor de traducción que se va a utilizar.

En este momento, están disponibles los siguientes motores

=over 2

=item * B<gpt5>: gpt-5.5 (via the C<llm> command)

i18n/src/xlate.deepl-ES.pod  view on Meta::CPAN


El texto original y el convertido se imprimen en formato L<cpp(1)> C<#ifdef>.

    #ifdef ORIGINAL
    original text
    #endif
    #ifdef JA
    translated Japanese text
    #endif

Puede recuperar sólo el texto japonés mediante el comando B<unifdef>:

    unifdef -UORIGINAL -DJA foo.ja.pm

=item B<space>

=item B<space+>

El texto original y el convertido se imprimen separados por una sola línea en blanco. Para C<espacio+>, también se imprime una nueva línea después del texto convertido.

=item B<xtxt>

Si el formato es C<xtxt> (texto traducido) o desconocido, sólo se imprime el texto traducido.

=back

=item B<--xlate-maxlen>=I<chars> (Default: 0)

Especifica la longitud máxima del texto que se enviará a la API de una sola vez. El valor por defecto 0 se refiere al límite propio del motor: para el servicio gratuito de DeepL, este es de 128K para la API (B<--xlate>) y de 5000 para la interfaz ...

=item B<--xlate-maxline>=I<n> (Default: 0)

Especifique el número máximo de líneas de texto que se enviarán a la API de una sola vez.

Establezca este valor en 1 si desea traducir una línea cada vez. Esta opción tiene prioridad sobre la opción C<--xlate-maxlen>.

=item B<--xlate-prompt>=I<text>

Especifica una indicación personalizada que se enviará al motor de traducción. Esta opción está disponible para los motores LLM (C<gpt3>, C<gpt4o>, C<gpt5>), pero no para DeepL. Puedes personalizar el comportamiento de la traducción proporciona...

=item B<--xlate-context>=I<text>

Especifique la información de contexto adicional que se enviará al motor de traducción. Esta opción puede utilizarse varias veces para proporcionar varias cadenas de contexto. La información de contexto ayuda al motor de traducción a comprender...

=item B<--xlate-context-window>=I<n>

(Context-aware engines only, e.g. C<gpt5> on the llm backend)
Número de bloques traducidos circundantes que se pasan como contexto de referencia al volver a traducir los bloques modificados (por defecto, 2). El contexto también incluye el texto fuente sin procesar que rodea la región modificada (encabezados,...

=item B<--xlate-cache-seed>=I<file>

Inicializa la caché de un nuevo documento a partir del archivo de caché de otro documento. Resulta útil para informes periódicos: se inicializa la caché del nuevo número con la del número anterior, de modo que los párrafos que no han cambiado...

=item B<--xlate-anonymize>=I<file>

Anonimiza las cadenas sensibles antes de enviarlas a la API de traducción y las restaura en la salida. El archivo de diccionario proporciona una entrada por elemento: en JSON (canónico, generable por máquina)

    [ { "category": "person",  "text": "山田太郎" },
      { "category": "company", "regex": "アクメ(株式会社)?" } ]

o en un formato de línea simple (C<category pattern>, C</.../> para expresiones regulares). Cada elemento se sustituye por una etiqueta de categoría como C<< <person id=1 /> >>; a la misma cadena siempre se le asigna la misma etiqueta, de modo que ...

Se puede generar un diccionario mediante una herramienta externa —por ejemplo, un modelo local que extraiga entidades sensibles—:

    llm -m <local-model> \
        -s 'Extract sensitive entities as a JSON array of objects
            with "category" and "text" fields.' \
        < report.md > report.anon.json
    greple -Mxlate --xlate-anonymize=report.anon.json ...

Se tolera la presencia de un BOM UTF-8 en el archivo. Los valores en formato de línea de encabezado pueden incluir un comentario al final, pero solo en su propia línea, no después del valor.

=item B<--xlate-anonymize-mark>[=I<regex>]

Recopila las entradas de anonimización a partir de las marcas en línea del propio documento. Marca la primera aparición como C<{{ person("山田太郎") }}> y todas las apariciones de la cadena en todo el documento quedarán anonimizadas. La marca...

Ten en cuenta que, con una opción de valor opcional como esta, se tomaría como valor cualquier argumento de archivo que le siguiera: escribe C<--xlate-anonymize-mark=> (con un C<=> al final) cuando utilices la notación predeterminada.

Se pueden configurar notaciones alternativas, por ejemplo, C<< --xlate-anonymize-mark='@@(?<category>[a-z][a-z0-9_]*):(?<text>[^\n]+?)@@' >> para marcas de estilo C<@@person:NAME@@>, o un formato de comentario HTML que permanece invisible en el Markd...

=item B<--xlate-template>[=I<regex>]

Trata las expresiones de plantilla (por defecto: Jinja2 C<{{ ... }}>, C<{% ... %}>, C<{# ... #}>) como marcadores de posición opacos: indica al modelo que las copie sin cambios y verifica, por bloque, que la respuesta contenga exactamente las mismas...

Ten en cuenta que, con una opción de valor opcional como esta, se tomaría como valor cualquier argumento de archivo que le siguiera: escribe C<--xlate-template=> (con un C<=> al final) cuando utilices la notación predeterminada.

=item B<--xlate-frontmatter>

Trata un bloque que comience por C<---> ... C<---> como «front matter» de YAML: exclúyelo de la traducción y de los fragmentos de contexto de la fase 2, y añade sus valores planos C<key: value> a las reglas de anonimización (categoría C<var>) ...

Deja siempre una línea en blanco después del cierre C<--->. Con un patrón de coincidencia de estilo párrafo, el front matter que se adentra directamente en el cuerpo del texto forma un bloque que abarca ambos y que la exclusión no puede suprimir...

=item B<--xlate-glossary>=I<glossary>

Especifique un ID de glosario que se utilizará para la traducción. Esta opción sólo está disponible cuando se utiliza el motor DeepL. El ID del glosario debe obtenerse de su cuenta de DeepL y garantiza la traducción coherente de términos espec...

=item B<--xlate-dryrun>

No llames a la API de traducción; en su lugar, muestra, a través de la pantalla de progreso, cada carga útil exactamente tal y como se transmitiría (tras la anonimización y el enmascaramiento). Resulta útil para comprobar qué sale de la máqui...

=item B<-->[B<no->]B<xlate-progress> (Default: True)

Consulta el resultado de la traducción en tiempo real en la salida de STDERR. La carga útil C<From> se muestra tal y como se transmite, tras la anonimización y el enmascaramiento.

=item B<--xlate-stripe>

Utilice el módulo L<App::Greple::stripe> para mostrar las partes coincidentes en forma de rayas de cebra. Esto es útil cuando las partes coincidentes están conectadas espalda con espalda.

La paleta de colores cambia según el color de fondo del terminal. Si desea especificarlo explícitamente, puede utilizar B<--xlate-stripe-light> o B<--xlate-stripe-dark>.

=item B<--xlate-mask>

Realiza la función de enmascaramiento y muestra el texto convertido tal cual sin restaurar.

=item B<--match-all>

Establece todo el texto del fichero como área de destino.

=item B<--lineify-cm>

=item B<--lineify-colon>



( run in 2.412 seconds using v1.01-cache-2.11-cpan-84e82930d8c )