App-Greple-xlate
view release on metacpan or search on metacpan
README.gpt5-DE.md view on Meta::CPAN
Sie können die Originaldatei mit dem nächsten Befehl [sed(1)](http://man.he.net/man1/sed) wiederherstellen.
sed -e '/^<<<<<<< /d' -e '/^=======$/,/^>>>>>>> /d'
- **colon**, _:::::::_
Der Original- und der übersetzte Text werden in einem benutzerdefinierten Containerstil von Markdown ausgegeben.
::::::: ORIGINAL
original text
:::::::
::::::: JA
translated Japanese text
:::::::
Der obige Text wird im HTML in Folgendes übersetzt.
<div class="ORIGINAL">
original text
</div>
<div class="JA">
translated Japanese text
</div>
Die Anzahl der Doppelpunkte beträgt standardmäÃig 7. Wenn Sie eine Doppelpunktsfolge wie `:::::` angeben, wird diese anstelle von 7 Doppelpunkten verwendet.
- **ifdef**
Original- und konvertierter Text werden im Format [cpp(1)](http://man.he.net/man1/cpp) `#ifdef` ausgegeben.
#ifdef ORIGINAL
original text
#endif
#ifdef JA
translated Japanese text
#endif
Sie können nur den japanischen Text mit dem Befehl **unifdef** abrufen:
unifdef -UORIGINAL -DJA foo.ja.pm
- **space**
- **space+**
Original- und konvertierter Text werden durch eine einzelne Leerzeile getrennt ausgegeben. Für `space+` wird nach dem konvertierten Text zusätzlich ein Zeilenumbruch ausgegeben.
- **xtxt**
Wenn das Format `xtxt` (übersetzter Text) oder unbekannt ist, wird nur der übersetzte Text ausgegeben.
- **--xlate-maxlen**=_chars_ (Default: 0)
Geben Sie die maximale Textlänge an, die auf einmal an die API gesendet wird. Der Standardwert 0 bedeutet das eigene Limit der Engine: Für den kostenlosen DeepL-Konto-Dienst sind das 128K für die API (**--xlate**) und 5000 für die Zwischenabl...
- **--xlate-maxline**=_n_ (Default: 0)
Geben Sie die maximale Anzahl von Textzeilen an, die auf einmal an die API gesendet werden.
Setzen Sie diesen Wert auf 1, wenn Sie eine Zeile nach der anderen übersetzen möchten. Diese Option hat Vorrang vor der Option `--xlate-maxlen`.
- **--xlate-prompt**=_text_
Geben Sie einen benutzerdefinierten Prompt an, der an die Ãbersetzungs-Engine gesendet werden soll. Diese Option ist für die LLM-Engines (`gpt3`, `gpt4o`, `gpt5`) verfügbar, jedoch nicht für DeepL. Sie können das Ãbersetzungsverhalten anpas...
- **--xlate-context**=_text_
Geben Sie zusätzliche Kontextinformationen an, die an die Ãbersetzungs-Engine gesendet werden. Diese Option kann mehrfach verwendet werden, um mehrere Kontextzeichenfolgen bereitzustellen. Die Kontextinformationen helfen der Ãbersetzungs-Engin...
- **--xlate-context-window**=_n_
(Context-aware engines only, e.g. `gpt5` on the llm backend)
Anzahl der umgebenden übersetzten Blöcke, die beim erneuten Ãbersetzen geänderter Blöcke als Referenzkontext übergeben werden (Standard: 2). Der Kontext umfasst auÃerdem den unverarbeiteten Quelltext um den geänderten Bereich (Ãberschrif...
- **--xlate-cache-seed**=_file_
Initialisieren Sie den Cache eines neuen Dokuments aus der Cache-Datei eines anderen Dokuments. Nützlich für periodische Berichte: Befüllen Sie den Cache der neuen Ausgabe mit dem der vorherigen Ausgabe, sodass unveränderte Absätze nicht ern...
- **--xlate-anonymize**=_file_
Anonymisieren Sie sensible Zeichenfolgen, bevor sie an die Ãbersetzungs-API gesendet werden, und stellen Sie sie in der Ausgabe wieder her. Die Wörterbuchdatei enthält einen Eintrag pro Element: in JSON (kanonisch, maschinell generierbar)
[ { "category": "person", "text": "å±±ç°å¤ªé" },
{ "category": "company", "regex": "ã¢ã¯ã¡(æ ªå¼ä¼ç¤¾)?" } ]
oder in einem einfachen Zeilenformat (`category pattern`, `/.../` für Regex). Jedes Element wird durch ein Kategorie-Tag wie `<person id="1" />` ersetzt; dieselbe Zeichenfolge erhält immer dasselbe Tag, sodass das Modell nachverfolgen kann, wer...
Ein Wörterbuch kann von einem externen Tool erzeugt werden â zum Beispiel von einem lokalen Modell, das sensible Entitäten extrahiert:
llm -m <local-model> \
-s 'Extract sensitive entities as a JSON array of objects
with "category" and "text" fields.' \
< report.md > report.anon.json
greple -Mxlate --xlate-anonymize=report.anon.json ...
Eine UTF-8-BOM in der Datei wird toleriert. Werte im Front-Matter-Zeilenformat dürfen einen nachgestellten Kommentar nur in einer eigenen Zeile enthalten, nicht nach dem Wert.
- **--xlate-anonymize-mark**\[=_regex_\]
Sammeln Sie Anonymisierungseinträge aus Inline-Markierungen im Dokument selbst. Markieren Sie das erste Vorkommen wie `{{ person("å±±ç°å¤ªé") }}`, und jedes Vorkommen der Zeichenfolge im gesamten Dokument wird anonymisiert. Die Markierung sel...
Beachten Sie, dass bei einer Option mit optionalem Wert wie dieser ein folgendes Dateiargument als Wert interpretiert würde: Schreiben Sie `--xlate-anonymize-mark=` (mit nachgestelltem `=`), wenn Sie die Standardnotation verwenden.
Alternative Notationen können konfiguriert werden, zum Beispiel `--xlate-anonymize-mark='@@(?<category>[a-z][a-z0-9_]*):(?<text>[^\n]+?)@@'` für Markierungen im Stil von `@@person:NAME@@` oder eine HTML-Kommentarform, die in gerendertem Markdow...
- **--xlate-template**\[=_regex_\]
Behandeln Sie Template-Ausdrücke (Standard: Jinja2 `{{ ... }}`, `{% ... %}`, `{# ... #}`) als undurchsichtige Platzhalter: Weisen Sie das Modell an, sie unverändert zu kopieren, und überprüfen Sie pro Block, dass die Antwort genau dieselben A...
Beachten Sie, dass bei einer Option mit optionalem Wert wie dieser ein folgendes Dateiargument als Wert genommen würde: Schreiben Sie `--xlate-template=` (mit einem nachgestellten `=`), wenn Sie die Standardnotation verwenden.
- **--xlate-frontmatter**
Behandeln Sie einen führenden `---` ... `---`-Block als YAML-Front-Matter: SchlieÃen Sie ihn von der Ãbersetzung und von den Kontext-Slices der Phase 2 aus, und fügen Sie seine flachen `key: value`-Werte den Anonymisierungsregeln (Kategorie `...
Lassen Sie immer eine Leerzeile nach dem abschlieÃenden `---`. Bei einem Absatzstil-Match-Pattern bildet Front-Matter, die direkt in den FlieÃtext übergeht, einen überspannenden Block, den der Ausschluss nicht unterdrücken kann (in diesem Fa...
- **--xlate-glossary**=_glossary_
Geben Sie eine Glossar-ID an, die für die Ãbersetzung verwendet werden soll. Diese Option ist nur bei Verwendung der DeepL-Engine verfügbar. Die Glossar-ID sollte aus Ihrem DeepL-Konto stammen und sorgt für eine konsistente Ãbersetzung spezi...
- **--xlate-dryrun**
( run in 1.323 second using v1.01-cache-2.11-cpan-b16cb0d3907 )