.XMLファイル形式は翻訳用に設計されておらず、正常にインポートするには追加の設定が必要です。
デフォルトの設定にはアスタリスク(*)が付いており、すべてのXML要素を翻訳用にインポートします。インポートオプションを使用して、インポート動作を変更できます。
AIサービスは、.XMLベースのファイルのファイル形式の問題を特定するのに非常に効果的です。
ファイル形式
-
.XML
インポートオプション
標準インポートルール
-
選択された要素(例:name、title、para)のみがインポートされます。アスタリスク()はすべての要素をインポートします。
-
選択された属性(例:name、title、para)のみがインポートされます。アスタリスク()はすべての属性をインポートします。
-
オプションが選択されている場合、翻訳可能テキスト内のすべての要素が翻訳可能インライン要素としてインポートされます。
-
選択されたインライン要素name、title、paraはタグに変換され、コンテンツは翻訳可能になりません。
-
テキストノードの隣接要素は、自動的にインラインタグに変換されます。
-
選択された要素コードは.HTMLとして処理されます。.HTMLのインポート設定(空白を保持やタグ(<br/>)で新しいセグメントを作成<4>など)をこれらの要素に使用できます。
選択された要素の値に.HTMLマークアップが含まれている場合は、このオプションを使用してください。特に指定がない限り、選択された要素の子要素には適用されません。
-
選択された要素はロック済としてインポートされます。
-
選択した属性は ロック済 としてインポートされます。
-
文字参照の一覧(カンマ区切り)を出力ファイルに入力します。
例:
-
正規表現を使用して、指定されたテキストをタグに変換。
-
ICUメッセージは自動的にtagsに変換されます。セグメントにインライン要素が含まれている場合、そのセグメントのICU解析はスキップされます。インライン要素を含まないセグメントは通常通り解析されます。
-
-
-
要素(HTMLとして処理)<1>オプションで示されているように要素がHTMLとして処理される場合、コメントはインポートされません。
-
XMLペアタグまたはサブ要素内でのセグメンテーション<1>を防ぐために選択します。これは、XMLにネストされた構造が含まれており、セグメンテーションによってテキストの論理的な意味が損なわれる場合に役立ちます。
-
.XSLスタイルシートをアップロードして、それから読み取り可能なプレビューファイルを生成できます。
XPathを使用したXML設定
XPath<1>クエリ言語を使用すると、複雑なインポートルールを作成したり、通常のインポートルールでは利用できない追加機能を使用したりできます。
XPath式は、実際のテキストノードではなく、テキスト/値が翻訳される要素や属性を定義する必要があります。
使用する前にXPathに慣れておくことをお勧めします。
、、およびは、10,000個を超えるXML要素を持つファイルでは処理されません。
-
TMコンテキスト(101%一致)を構成します(該当する場合)。
-
各要素の要素またはコンテキスト属性をインポートします。
-
要素または各要素の最大訳文文長をインポートします。各セグメントの文字数制限は、エディタ内のビューに表示されます。制限を超えた文字は赤で強調表示されます。
-
要素内の空白を保持するには、空欄のままにします。すべての要素のすべての空白を保持するには xml:whitespace='preserve'. //*<1> を適用するか、任意のXPath式を使用します。
-
セグメント化しないXML要素または属性を指定します。除外するノードを特定するXPath式を入力します。これらのノードから抽出されたテキストは、小さな単位に分割されるのではなく、単一のセグメントとして保持されます。
//element[@attr='value']と入力して、属性
attr=\"value\"を含むすべての<element>ノードをセグメンテーションから除外します。
XSLTスタイルシートを使用したHTMLプレビュー
XSLT言語(Extensible Stylesheet Language Transformations)を使用して、.XMLドキュメントをインコンテキストプレビュー目的で.HTMLファイル形式に変換できます。したがって、ドキュメントメニューの訳文をプレビューからダウンロードされたプレビューファイルには、HTML拡張子が付きます。Phraseは現在XSLT 2.0をサポートしています。
プレビューに使用されるXSLTは、原文ではなく訳文に基づいている必要があります。
ファイルを選択をクリックしてスタイルシートをインポートします。
XSLTをダウンロードをクリックして、ファイルインポート後にスタイルシートをダウンロードします。
XMLファイルのCDATA
CDATAはCharacter Dataの略で、パーサーによって処理されず、マークアップとして認識されるテキストブロックとして定義されます。<, >、&などの定義済みエンティティは、入力が必要であり、マークアップ内では一般的に読み取りが困難です。そのような場合には、CDATAセクションを使用できます。
CDATAに埋め込みの.HTMLが含まれている場合、対応するXML要素をの下にリストする必要があります。
ソースファイルにCDATAが含まれており、が使用されている場合、CDATAは完了ファイルのすべてのセグメントに追加されます。
CDATAは、句読点やスペースなど、セグメントの区切りが明確に示されている場合にのみセグメント化されます。
原文:
<text><![CDATA[Translatable text A. Translatable text B.]]></text>
訳文:
<text><![CDATA[Translatable text A.]]><![CDATA[ ]]><![CDATA[Translatable text B.]]></text>
完了したファイルは有効な.XMLであり、XMLビューアはテキストを翻訳可能テキスト A. 翻訳可能テキスト Bとして正しく表示します。
多言語ファイルは、インポート前に言語がマッピングされた複数のバイリンガルジョブとしてインポートされます。これらはジョブテーブル内でと表示されます。複数の訳文言語にインポートされた場合、完了ファイルはすべての訳文言語で構成されます。
Phraseは、訳文が空欄であっても、すべての段落に対して原文要素と訳文要素の両方が存在するXMLファイルをサポートしています。原文と訳文のセグメンテーションが異なる場合、原文のセグメンテーションが優先されます。
個々の言語要素はすべて同じtrans-unit要素の子孫である必要があり、ある言語が他の言語の中に含まれていてはいけません。原文コンテンツと訳文コンテンツを属性値に格納することはできません。trans-unit要素内の原文または訳文のXPathに一致する要素が複数ある場合、最初の要素のみが翻訳用にインポートされます。
-
ジョブを作成する際は、インポートオプションを適用する前に、ペインからを選択してください。指定がない場合、ファイルは標準の.XMLとしてインポートされます。
-
原文.XMLファイルのタグコンテンツは、メニューのタグを展開をクリックすることでエディタ上で可視化でき、F2をクリックすることで編集できます。
例:
英語からドイツ語およびフランス語へ部分的に翻訳されたテキストのサンプル。すべての<tuv lang=\"en\">、<tuv lang=\"de\">、および<tuv lang=\"fr\">は、同じ<tu>要素の親です。
<?xml version="1.0" encoding="utf-8"?>
<root>
翻訳不要箇所。
<tu note="context note" key="ID 254" maxlen="16">
<tuv lang="en">
<seg>最初のセグメント。</seg>
</tuv>
<tuv lang="de">
<seg>Erste segment</seg>
</tuv>
<tuv lang="fr">
<seg></seg>
</tuv>
</tu>
<tu note="another context note" key="ID 255" maxlen="18">
<tuv lang="en">
<seg>2番目のセグメント。</seg>
</tuv>
<tuv lang="de">
<seg></seg>
</tuv>
<tuv lang="fr">
<seg></seg>
</tuv>
</tu>
</root>
インポートオプション
多言語.XMLファイルのインポートには、XPathクエリ言語を使用する必要があります。参考資料として上記の例を参照してください。XPath式は、テキスト/値を翻訳すべき要素を定義するものであり、実際のテキストノードを定義するものではありません。
-
//tu -
tuv[@lang='en']/seg(親要素//tuに関連して) -
原文または訳文内のすべての要素は、ここで翻訳不要箇所として指定されない限り、翻訳可能なインライン要素と見なされます。
-
-
各要素の要素またはコンテキスト属性をインポートします。
-
要素または各要素の最大訳文文長をインポートします
-
文字参照の一覧(カンマ区切り)を出力ファイルに入力します。
例:
-
正規表現を使用して、指定されたテキストをタグに変換。
-
ICUメッセージは自動的にtagsに変換されます。セグメントにインライン要素が含まれている場合、そのセグメントのICU解析はスキップされます。インライン要素を含まないセグメントは通常通り解析されます。
-
ファイルに含まれる HTMLタグをインポートします。タグは.HTMLファイルインポート設定で使用できます。段落タグ
<p>は、 が選択されていない場合でも、新しいセグメントを作成します。 -
ファイルに含まれる HTMLタグをインポートします。タグは.HTMLファイルインポート設定で使用できます。
-
テキストは、セルごとに1つのセグメントではなく、一般的な セグメンテーションルール によってセグメント化されます。
注意
訳文を含むファイルに を適用すると、原文と訳文でセグメント数が異なる場合があります。
-
デフォルトの確定ステータスと、確定済セグメントを自動的に TM に追加するかどうかを選択します。
-
.XSLスタイルシートをアップロードして、それから読み取り可能なプレビューファイルを生成できます。
例::