App-Greple-xlate

 view release on metacpan or  search on metacpan

i18n/src/xlate.deepl-ET.pod  view on Meta::CPAN


    # macros.yaml           # macros-redacted.yaml
    preamble: |             preamble: |
      {% macro person(name) %}{{ name }}{% endmacro %}
                              {% macro person(name) %}(関係者){% endmacro %}

Jäta embedz-plokid tõlkimisest välja, kui dokument neid sisaldab:

    --exclude '^```embedz\n(?s:.*?)^```\n'

=head1 OPTIONS

=over 7

=item B<--xlate>

=item B<--xlate-color>

=item B<--xlate-fold>

=item B<--xlate-fold-width>=I<n> (Default: 70)

Käivitage tõlkimisprotsess iga sobitatud ala jaoks.

Ilma selle valikuta käitub B<greple> nagu tavaline otsingukäsklus. Seega saate enne tegeliku töö käivitamist kontrollida, millise faili osa kohta tehakse tõlge.

Käsu tulemus läheb standardväljundisse, nii et vajadusel suunake see faili ümber või kaaluge mooduli L<App::Greple::update> kasutamist.

Valik B<--xlate> kutsub B<--xlate-color> valiku B<--color=never> valikul.

Valikuga B<--xlate-fold> volditakse konverteeritud tekst määratud laiusega. Vaikimisi laius on 70 ja seda saab määrata valikuga B<--xlate-fold-width>. Neli veergu on reserveeritud sisselülitamiseks, nii et iga rida võib sisaldada maksimaalselt ...

=item B<--xlate-engine>=I<engine>

Määrab kasutatava tõlkemootori.

Praegu on saadaval järgmised mootorid

=over 2

=item * B<gpt5>: gpt-5.6-terra (via the C<llm> command)

=item * B<deepl>: DeepL API (via the C<deepl> command)

=item * B<gpt3>: gpt-3.5-turbo (legacy, via the C<gpty> command)

=item * B<gpt4o>: gpt-4o-mini (legacy, via the C<gpty> command)

=back

Mootorimooduleid otsitakse esmalt tagapõhja nimeruumi alt (C<llm>, seejärel C<gpty>), seejärel otse C<App::Greple::xlate> all. Seega laadib C<gpt5> sisse C<App::Greple::xlate::llm::gpt5>, mis kutsub välja käsu C<llm>, samas kui C<gpt4o> kasutab ...

=item B<--xlate-labor>

=item B<--xlabor>

Selle asemel, et kutsuda tõlkemootorit, oodatakse tööd. Pärast tõlgitava teksti ettevalmistamist kopeeritakse need lõikelauale. Eeldatakse, et te kleebite need vormi, kopeerite tulemuse lõikelauale ja vajutate return.

=item B<--xlate-to> (Default: C<EN-US>)

Määrake sihtkeel. LLM-mootorid aktsepteerivad mis tahes keelenime või koodi, mida mudel mõistab; see interpoleeritakse tõlkeprompti. Saadavalolevad keeled saate teada käsu C<deepl languages> abil, kui kasutate mootorit B<DeepL>.

=item B<--xlate-from> (Default: C<ORIGINAL>)

Silt, mida kasutatakse algteksti jaoks väljundvormingutes C<conflict>, C<colon> ja C<ifdef>. Mootori B<DeepL> puhul edastatakse allikakeelena ka mitte-vaikimisi väärtus.

=item B<--xlate-format>=I<format> (Default: C<conflict>)

Määrake originaal- ja tõlgitud teksti väljundformaat.

Järgmised vormingud, välja arvatud C<xtxt>, eeldavad, et tõlgitav osa on ridade kogum. Tegelikult on võimalik tõlkida ainult osa reast, kuid muu formaadi kui C<xtxt> määramine ei anna mõttekaid tulemusi.

=over 4

=item B<conflict>, B<cm>

Algne ja teisendatud tekst trükitakse L<git(1)> konfliktimärgistuse formaadis.

    <<<<<<< ORIGINAL
    original text
    =======
    translated Japanese text
    >>>>>>> JA

Originaalfaili saate taastada järgmise käsuga L<sed(1)>.

    sed -e '/^<<<<<<< /d' -e '/^=======$/,/^>>>>>>> /d'

=item B<colon>, I<:::::::>

Algne ja tõlgitud tekst väljastatakse markdowni kohandatud konteineri stiilis.

    ::::::: ORIGINAL
    original text
    :::::::
    ::::::: JA
    translated Japanese text
    :::::::

Ülaltoodud tekst tõlgitakse HTML-is järgmiselt.

    <div class="ORIGINAL">
    original text
    </div>
    <div class="JA">
    translated Japanese text
    </div>

Koolonite arv on vaikimisi 7. Kui määrate koolonite järjestuse nagu C<:::::>, kasutatakse seda 7 kooloni asemel.

=item B<ifdef>

Algne ja teisendatud tekst trükitakse L<cpp(1)> C<#ifdef> formaadis.

    #ifdef ORIGINAL
    original text
    #endif
    #ifdef JA
    translated Japanese text
    #endif

Saate ainult jaapani teksti taastada käsuga B<unifdef>:

    unifdef -UORIGINAL -DJA foo.ja.pm

=item B<space>

=item B<space+>

Algne ja teisendatud tekst on trükitud ühe tühja reaga eraldatud. C<space+> puhul väljastab see ka uue rea pärast teisendatud teksti.

=item B<xtxt>

Kui formaat on C<xtxt> (tõlgitud tekst) või tundmatu, trükitakse ainult tõlgitud tekst.

=back

=item B<--xlate-maxlen>=I<chars> (Default: 0)

Määrake API-le korraga saadetava teksti maksimaalne pikkus. Vaikimisi väärtus 0 tähendab mootori enda piirangut: DeepLi tasuta kontoteenuse puhul on see API-le (B<--xlate>) 128K ja lõikelauale (B<--xlate-labor>) 5000. Kui kasutate Pro-teenust, ...

=item B<--xlate-maxline>=I<n> (Default: 0)

Määrake API-le korraga saadetava teksti maksimaalne ridade arv.

Määrake selle väärtuseks 1, kui soovite tõlkida ühe rea korraga. See valik on ülimuslik valikust C<--xlate-maxlen>.

=item B<--xlate-prompt>=I<text>

Määrake tõlkemootorile saadetav kohandatud käsk. See valik on saadaval LLM-mootorite (C<gpt3>, C<gpt4o>, C<gpt5>) puhul, kuid mitte DeepL-i puhul. Võite kohandada tõlkimiskäitumist, andes AI-mudelile konkreetseid juhiseid. Kui käsk sisaldab C...

=item B<--xlate-context>=I<text>

Määrake lisakonteksti teave, mis saadetakse tõlkemootorile. Seda valikut saab kasutada mitu korda, et anda mitu kontekstijada. Kontekstiandmed aitavad tõlkemootoril mõista tausta ja toota täpsemaid tõlkeid.

=item B<--xlate-context-window>=I<n>

(Context-aware engines only, e.g. C<gpt5> on the llm backend)
Muudetud plokkide uuesti tõlkimisel viitekontekstina edastatavate ümbritsevate tõlgitud plokkide arv (vaikimisi 2). Kontekst hõlmab ka muudetud piirkonna ümbruses olevat töötlemata allikateksti (pealkirjad, loendistruktuur, pildiallkirjad) nin...

=item B<--xlate-cache-seed>=I<file>

Initsialiseerige uue dokumendi vahemälu teise dokumendi vahemälufaili põhjal. Kasulik perioodiliste aruannete puhul: algandmetena kasutage uue väljaande vahemälus eelmise väljaande andmeid, nii et muutmata lõikeid ei tõlgita uuesti ja muudetu...

=item B<--xlate-anonymize>=I<file>

Anonüümistage tundlikud stringid enne nende saatmist tõlke-API-le ja taastage need väljundis. Sõnastikufailis on iga elemendi kohta üks kanne: JSON-vormingus (kanoniline, masinloetav)

    [ { "category": "person",  "text": "山田太郎" },
      { "category": "company", "regex": "アクメ(株式会社)?" } ]

või lihtsas reaformaadis (C<category pattern>,  regulaaravaldise C</.../>jaoks). Iga element asendatakse kategooriamärgiga, näiteks C<< <person id="1" /> >>; sama string saab alati sama märgi, nii et mudel saab jälgida, kes on kes. Tundmatuid JS...

Sõnastiku saab genereerida välise tööriistaga – näiteks tundlikke entiteete eraldava kohaliku mudeliga:

    llm -m <local-model> \
        -s 'Extract sensitive entities as a JSON array of objects
            with "category" and "text" fields.' \
        < report.md > report.anon.json
    greple -Mxlate --xlate-anonymize=report.anon.json ...

Failis olevat UTF-8 BOM-i aktsepteeritakse. Esilehe rea formaadis olevad väärtused võivad sisaldada lõpus kommentaari ainult oma eraldi real, mitte väärtuse järel.

=item B<--xlate-anonymize-mark>[=I<regex>]

Koguge anonüümimise kanded dokumendi enda sisseehitatud märkidest. Märgi esimene esinemine näiteks C<{{ person("山田太郎") }}> ja kogu dokumendis esinev string anonüümistatakse. Märge ise jääb nii allikasse kui ka tõlkesse, seega saab ...

Pange tähele, et sellise valikulise väärtusega valiku puhul võetakse järgnev failiargument väärtusena: kirjutage C<--xlate-anonymize-mark=> (koos lõpus oleva C<=>-ga), kui kasutate vaikimisi märgistust.

Võimalik on konfigureerida alternatiivseid märkimisviise, näiteks C<< --xlate-anonymize-mark='@@(?<category>[a-z][a-z0-9_]*):(?<text>[^\n]+?)@@' >> C<@@person:NAME@@>-stiilis märkide jaoks või HTML-kommentaari vorm, mis jääb renderdatud Markdo...

=item B<--xlate-template>[=I<regex>]

Käsitle malliväljendeid (vaikimisi: Jinja2 C<{{ ... }}>, C<{% ... %}>, C<{# ... #}>) läbipaistmatute asendusmärkidena: anna mudelile juhis need muutmata kujul kopeerida ja kontrolli iga ploki puhul, et vastus sisaldaks täpselt samu väljendeid, ...

Pange tähele, et sellise valikulise väärtusega valiku puhul võetakse järgnev failiargument väärtusena: kirjutage C<--xlate-template=> (koos lõpus oleva C<=>-ga), kui kasutate vaikimisi märgistust.

=item B<--xlate-frontmatter>

Käsitlege alguses olevat C<---> ... C<---> plokki kui YAML-i esiosa: jäta see tõlkest ja 2. faasi kontekstilõikudest välja ning lisa selle lihtsad C<key: value> väärtused anonüümimise reeglitesse (kategooria C<var>) turvavõrguna. Mitme sise...

Jäta alati tühirida sulgevate C<---> järel. Lõigu-stiilis sobitusmustri korral moodustab sissejuhatus, mis ulatub otse põhiteksti sisse, ühe üle ulatuva ploki, mida välistamine ei suuda maha suruda (sel juhul kuvatakse hoiatus); väärtused a...

=item B<--xlate-glossary>=I<glossary>

Määrake sõnastiku ID, mida kasutatakse tõlkimisel. See valik on saadaval ainult siis, kui kasutatakse DeepL mootorit. Sõnastiku ID tuleks saada teie DeepL kontolt ja see tagab konkreetsete terminite järjepideva tõlkimise.

=item B<--xlate-dryrun>



( run in 1.596 second using v1.01-cache-2.11-cpan-a49fcb8fa48 )