App-Greple-xlate

 view release on metacpan or  search on metacpan

i18n/src/xlate.deepl-ZH.pod  view on Meta::CPAN


=item B<colon>, I<:::::::>

原文和译文以 markdown 的自定义容器样式输出。

    ::::::: ORIGINAL
    original text
    :::::::
    ::::::: JA
    translated Japanese text
    :::::::

以上文本将在 HTML 中翻译为以下内容。

    <div class="ORIGINAL">
    original text
    </div>
    <div class="JA">
    translated Japanese text
    </div>

冒号数默认为 7。如果指定冒号序列,如 C<:::::>,则会使用它来代替 7 个冒号。

=item B<ifdef>

原始文本和转换后的文本以 L<cpp(1)> C<#ifdef> 格式打印。

    #ifdef ORIGINAL
    original text
    #endif
    #ifdef JA
    translated Japanese text
    #endif

你可以通过B<unifdef>命令只检索日文文本。

    unifdef -UORIGINAL -DJA foo.ja.pm

=item B<space>

=item B<space+>

原始文本和转换后的文本在打印时以单行空行隔开。对于 C<space+>,它还会在转换后的文本后输出一个换行符。

=item B<xtxt>

如果格式是C<xtxt>(翻译文本)或不知道,则只打印翻译文本。

=back

=item B<--xlate-maxlen>=I<chars> (Default: 0)

指定一次发送至 API 的文本最大长度。 默认值 0 表示引擎自身的限制:对于 DeepL 免费账户服务,API(B<--xlate>)的限制为 128K,剪贴板接口(B<--xlate-labor>)的限制为 5000。 如果您使用的是 Pro ...

=item B<--xlate-maxline>=I<n> (Default: 0)

指定一次发送到 API 的最大文本行数。

如果想一次翻译一行,则将该值设为 1。该选项优先于 C<--xlate-maxlen> 选项。

=item B<--xlate-prompt>=I<text>

指定要发送给翻译引擎的自定义提示词。此选项适用于 LLM 引擎(C<gpt3>, C<gpt4o>, C<gpt5>),但不适用于 DeepL。您可以通过向 AI 模型提供具体指令来自定义翻译行为。如果提示词中包含 C<%s>,å®...

=item B<--xlate-context>=I<text>

指定要发送给翻译引擎的其他上下文信息。此选项可多次使用,以提供多个上下文字符串。上下文信息有助于翻译引擎理解背景并生成更准确的翻译。

=item B<--xlate-context-window>=I<n>

(Context-aware engines only, e.g. C<gpt5> on the llm backend)
在重新翻译已修改的块时,作为参考上下文传递的周围已翻译块的数量(默认值为 2)。该上下文还包括已修改区域周围的原始源文本(标题、列表结构、图注)以及(如有)从缓存中恢复çš...

=item B<--xlate-cache-seed>=I<file>

从另一个文档的缓存文件初始化新文档的缓存。这对于定期报告非常有用:使用上一期报告的缓存作为新期报告缓存的初始值,这样未更改的段落就不会被重新翻译,而编辑过的段落则会保ç...

=item B<--xlate-anonymize>=I<file>

在将敏感字符串发送至翻译 API 之前对其进行匿名化处理,并在输出中恢复其原始内容。词典文件为每个项目提供一条条目:以 JSON 格式(规范的、可由机器生成)

    [ { "category": "person",  "text": "山田太郎" },
      { "category": "company", "regex": "アクメ(株式会社)?" } ]

或采用简单的行格式(C<category pattern>,  表示C</.../>正则表达式)。每个项目都会被替换为类别标签,例如 C<< <person id="1" /> >>;同一字符串始终对应相同的标签,因此模型能够区分不同对象ã...

词典可由外部工具生成——例如用于提取敏感实体的本地模型:

    llm -m <local-model> \
        -s 'Extract sensitive entities as a JSON array of objects
            with "category" and "text" fields.' \
        < report.md > report.anon.json
    greple -Mxlate --xlate-anonymize=report.anon.json ...

文件中允许存在 UTF-8 BOM。前置信息行格式的值仅可在单独一行末尾带有尾注,不可紧跟在值之后。

=item B<--xlate-anonymize-mark>[=I<regex>]

从文档本身的内联标记中收集匿名化条目。 将首次出现的位置标记为 C<{{ person("山田太郎") }}>,该字符串在整个文档中的所有出现位置均会被匿名化。标记本身会保留在源文档和译文中,因æ...

请注意,对于此类可选值的选项,后续的文件参数将被视为该值:在使用默认表示法时,应写为 C<--xlate-anonymize-mark=>(末尾跟一个 C<=>)。

可以配置其他表示法,例如 C<< --xlate-anonymize-mark='@@(?<category>[a-z][a-z0-9_]*):(?<text>[^\n]+?)@@' >> 用于 C<@@person:NAME@@> 风格的标记,或者一种在渲染后的 Markdown 中不可见的 HTML 注释形式。 标记规则æ...

=item B<--xlate-template>[=I<regex>]

将模板表达式(默认:Jinja2 C<{{ ... }}>、C<{% ... %}>、C<{# ... #}>)视为不透明占位符:指示模型将其原样复制,并按块验证响应中是否包含完全相同的表达式,且每个表达式出现的次数完全一致...

请注意,对于此类可选值选项,后续的文件参数将被视为该值:在使用默认表示法时,应写为 C<--xlate-template=>(末尾跟 C<=>)。

=item B<--xlate-frontmatter>

将开头的 C<---> ... C<---> 块视为 YAML 前置信息:将其排除在翻译和第二阶段上下文切片之外,并将其中平铺的 C<key: value> 值添加到匿名化规则(类别 C<var>)中作为安全保障。 当存在多个输入æ...

在闭合的 C<---> 之后始终留出一行空行。若采用段落风格的匹配模式,直接与正文相连的前置信息将形成一个跨段块,该块无法被排除规则抑制(此时会输出警告); 这些值仍会被匿名化,ä...

=item B<--xlate-glossary>=I<glossary>

指定用于翻译的词汇表 ID。该选项仅在使用 DeepL 引擎时可用。词汇表 ID 应从您的 DeepL 账户获取,可确保特定术语翻译的一致性。

=item B<--xlate-dryrun>



( run in 1.178 second using v1.01-cache-2.11-cpan-302cb4679cc )