解析は、選択したファイルの文字数とワード数を計算し、以下を特定します。
解析では、レビュワーが行った修正数も表示できます。
解析は、プロジェクトマネージャーまたは管理者が作成できます。言語スペシャリストは、独自の解析を実行することはできません。ベンダーは、共有ジョブ/プロジェクトの解析を作成できます。
一部のCATツールでは、解析を統計と呼ぶことがあります。
組織の分析は、分析ダッシュボードによって提供されます。
国によって異なる課金単位が使用されるため、3つの計算方法が用意されています。
-
文字数
スペースを含まない。
-
ワード数
単語間にスペースを使用する言語(中国語、日本語、タイ語を除く)の場合。
-
枚数
スペースを含めて1800文字—ファイル内の実際の枚数とは無関係です。
言語ごとにカウント方法が異なるため、表示されるワードカウントは、他のアプリケーションで生成されるワードカウントと異なる場合があります。
解析用のワードカウントは、MTU計算のそれとは異なります。
-
各結合タグは1つのスペースに置き換えられます。
-
その他のタグは削除されます。
単語の区切りにスペースを使用する言語(例:英語)の場合:
-
+-,.を含む各数値シーケンスは、1文字に置き換えられます(regex式[+-]?[0-9]+([., -]?[0-9]++)*+を使用)。 -
各スペースのシーケンスは、1つのスペースに置き換えられます。
-
セグメントの先頭と末尾にあるスペースは削除されます。
-
スペース以外の各文字シーケンスが1ワードとしてカウントされます。
単語の区切りにスペースを使用しない言語(例:日本語)の場合:
-
一部の句読点はテキストから削除されます(regex式
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}]を使用)。 -
セグメントは、スペース以外の(NWS)漢字、ひらがな、カタカナ、タイ語スクリプトに属する文字シーケンスと、それらのスクリプトに属さない文字シーケンス(WS)に分割されます。
-
ワードの合計数 = (NWSからのワード数) + (WSからのワード数)。
-
WSからのワード数は、英語の場合と同様に計算されます。
-
NWSのワード数は、スペースを除いた文字数です。
-
タイ語の場合、ワード数はスペースを除いた文字数を2で割った数です。
備考
CJK言語の文字は、文字数とワード数の両方としてカウントされます。
解析を作成するには、以下の手順に従ってください:
-
-
解析する<1>をクリックします。
-
ドロップダウン一覧から
-
必要に応じて名前を入力します。
-
解析の命名に使用できるマクロ:
-
{projectName} -
{sourceLang}原文言語を追加します
-
{targetLang}訳文言語を追加します。複数の言語が解析される場合、言語は空欄になります。
-
{userName}割り当てられたリンギストまたはベンダーのユーザー名を追加します。複数のリンギストが割り当てられている場合、名前は空欄になります。
-
{workflow} -
{innerId} -
{fileName}解析に複数のファイル/ジョブが使用される場合、
{fileName}は空欄になります。
-
-
-
解析オプションを選択します。特に以下の点に注意してください:
-
オプションを適用すると、数値はワードとして計算されないため、ワードカウントに影響します。
-
オプションは、解析対象のジョブ内のセグメントを、TMとの比較だけでなく、ファイル内の類似性についても比較します。
がチェックされている場合、内部ファジーの一致は、新しく作成された解析で別のカテゴリとして表示されます。以下に例を挙げます。
10個の原文のワード数を持つ翻訳ジョブには、最後の文字のみが異なる以下のセグメントが含まれます。
-
私は新しい車を買いました。
-
私は新しい車を買いました!
TMで一致が見つからない場合、デフォルト解析が表示されます。
IFオプション
TMカテゴリ: 0%-49%
TMカテゴリ: 95%-99%
IFカテゴリ: 95%-99%
IFを含める無効
10ワード数
IFを含める有効 + IFを分離する無効
5ワード数
5ワード数
IFを含める + IFを分離する有効
5ワード数
5ワード数
-
-
-
解析する<1>をクリックします。
解析、または複数の解析が一覧に追加されます。
-
一覧の解析をクリックすると、詳細ページで表示するか、プロジェクト管理アプリケーションでレンダリングするためにダウンロードできます。
備考
解析オプションは、解析の作成時、プロジェクトレベル、または設定のグローバル設定で設定できます。
3種類の解析タイプが用意されています。
デフォルト解析は、原文セグメントの事前翻訳時に実行される標準的な解析です。これは、ジョブのベースライン解析を提供し、ポストエディット解析と併用することで、そのジョブの翻訳にどれだけの労力が費やされたかを判断できます。このベースラインは、クライアント向けの見積もりを作成する際の基礎としても使用されます。
事前翻訳で設定されたTMしきい値がデフォルトで使用されますが、必要に応じて変更可能です。
セグメント/単語/文字数の内訳が生成され、プロジェクトで使用される場合、翻訳不要箇所、内部のあいまい一致、およびQPS(品質評価スコア)(有効な場合)とともにTM一致が特定されます。
注意
翻訳後にデフォルト解析を実行すると、不正確な解析結果が生成されます。
ポストエディット解析は訳文セグメントに対して実行され、編集の労力、つまりリンギストや校正者がテキストに対してどれだけの編集を必要としたかを示します。これはポストエディットが完了した後に実行されます。
リンギストが未翻訳セグメントをクリックすると、その時点で最も高い翻訳メモリ一致、機械翻訳の提案、および/または翻訳不要箇所がそのセグメントに対して保存され、ポストエディット解析で使用されます。
ポストエディット解析はどのワークフローステップからでも開始でき、利用可能な原文(TM/MTなど)から挿入されたテキストと、セグメント訳文におけるポストエディット後の結果との差分として計算されます。
ポストエディット解析は、従来の翻訳メモリ解析を拡張し、機械翻訳(MT)および翻訳不要箇所(NT)を含めます。サードパーティ製MTエンジンもサポートされています。
注意
およびを無効にしても、TM/MT一致が解析から除外されるわけではありません。この場合、解析はポストエディットの労力ではなく、利用可能なより高い一致のスコアを考慮します。
ポストエディット解析における101%のTM結果は、必ずしもそのセグメントがTMから翻訳されたことを意味するわけではありません。
例:
MTを使用して翻訳されたジョブであっても、が無効になっており、セグメントを開いたときに101%のTM一致が利用可能であった場合、101%のTMとして表示されることがあります。
解析後のオプション
ポストエディットオプションは、翻訳メモリ(TM)、翻訳不要箇所(NT)、および機械翻訳(MT)からの一致に対して必要なポストエディットの労力を計算するために使用されます。
TMポストエディットを解析が有効
-
リンギストによる編集が必要な高一致率を含む、低品質なTMを対象としています。
-
TMのポストエディット作業を示します。
-
解析において100%一致のみを含みます。TMからのコンテキスト内101%一致は、計算に影響を与えません。
TMのポストエディット解析を無効にする
-
コストを削減するために、一致を可能な限り編集しない高品質なTMを対象としています。
-
101%と100%の両方を示します。
-
セグメントが開かれたときにリンギストに提示されるTM一致を示します(実際のリンギストのポストエディット作業ではありません)。
-
機械翻訳およびNTのポストエディット作業を示します。
NT/MTのポストエディット解析を有効にする
-
MTまたはNTの提案が編集されずに受け入れられた場合、解析では100%一致として表示されます。
-
リンギストがMTを変更した場合、一致率は低下します。スコア計算アルゴリズムは、翻訳メモリのあいまい一致のスコア計算に使用されるものと同じです。
-
NTを編集すると、そのセグメントは0~49%のNTとして表示されます。
NT/MTのポストエディット解析を無効にする
-
推定スコアのないMT/NTからのエントリは、TMの0%~49%一致とみなされます。これらは、MTを考慮せず、リンギストによって翻訳されたものとして示されます。
-
QPS(品質評価スコア)およびPhrase Language AIの75%を超える一致は、それぞれのMT列に表示されます。
-
セグメントが開かれたときにリンギストに提示されるNT/MT一致を示します(実際のリンギストのポストエディット作業ではありません)。
原文の更新前にポストエディット解析を自動生成する
-
解析が作成されます:
-
更新されたジョブごとに。
-
個々のプロバイダごとに個別に、かつそのプロバイダに割り当てられます。
-
-
以下の場合、解析は作成されません:
-
リンギストまたはベンダーが割り当てられていない場合。
-
-
解析は確定済および翻訳済のセグメントをカウントします。
-
解析は以下の命名規則に従います:
-
UpdateSource #{innerID}{workflow}
-
-
解析は、ユニットのカウント(原文)、NTポストエディットを解析する、TMポストエディットを解析する、およびMTポストエディットを解析するが選択された状態で作成されます。
ユニットのカウント
-
解析で表示するワードカウントを選択します。訳文のワードカウントが原文のワードカウントより多くなる場合があります。
一致スコアリングには影響しません。
解析の比較機能は、ワークフローのステップがあるプロジェクトでのみ利用可能です。これは、異なるワークフローのステップにあるファイルの2つのバージョンをセグメントレベルで比較し、2つのバージョンがどのように異なるかを解析します。解析用のプロジェクト固有の設定がない場合、デフォルトの設定が使用され、不正確なレポートになる可能性があります。
例:
解析は複数のジョブに対して実行でき、以下の2つの方法でグループ化できます:
-
プロバイダ別に解析する
-
多くのジョブがさまざまな言語スペシャリストやプロバイダに割り当てられているプロジェクトの場合。用途:
-
個々の言語スペシャリストやプロバイダに割り当てられたファイルを含む、個別の解析を作成します。
-
解析をプロバイダに割り当て、その言語スペシャリストやプロバイダが解析を閲覧できるようにします。
プロバイダに課金率ルールが適用されている場合、そのオプションが事前に選択されます。
-
-
-
言語ごとに解析
解析の原文ファイルが更新されると、解析テーブル内で期限切れ とマークされます。
再計算では、元の解析に使用された設定が適用されます。
プロバイダは、バイヤーが作成した解析を再計算することはできません。
新しい原文ファイルを使用して再計算するには、以下の手順に従います。
解析ビューをカスタマイズする
、、、、およびの各列は、解析テーブルで表示/非表示を切り替えることができます。列もポストエディット解析に使用でき、セグメントの編集に費やされた秒数が表示されます。
解析をダウンロードする
解析をダウンロードするには、次の手順に従います。
-
ダウンロードをクリックしてドロップダウンメニューを表示し、以下を選択します。
-
CSV(カンマ区切り値)で、文字数を含めるか含めないかを選択でき、スプレッドシートアプリケーションで読み取り可能です。
-
LOG(SDL Tradosファイル形式に類似)で、ほとんどのプロジェクト管理アプリケーションで読み取り可能です。
-
JSON(JavaScript Object Notation)で、軽量なデータ交換用ファイル形式です。
JSONファイル形式でダウンロードされた解析のみに、一致タイプごとのNT、MT、TM、および内部あいまい一致(IF)データの詳細が含まれます。
-
-
ファイル形式を選択すると、ダウンロードが開始されます。
これらのファイルは、ほとんどのプロジェクト管理ソフトウェアシステムにインポートできます。
課金率ルールを適用する課金率ルール
解析では、単語数/文字数/ページ数に対して割引を適用できます。割引後の翻訳ボリュームが即座に計算され、解析内の行に直接表示されます。
解析から課金率ルールを削除するには、ボタンの横のフィールドを空欄にします。
課金率ルールが解析に適用されると、解析のダウンロードファイルには、各一致カテゴリの加重単語数が表示されます。
解析をプロバイダに割り当てるには、次の手順に従ってください。
-
一覧から解析を選択し、編集をクリックします。
編集ページが開きます。
-
ドロップダウン一覧からプロバイダを選択します。
-
保存をクリックします。
解析は、割り当てられたプロバイダがリンギストポータルで利用できるようになります。