すべてのMTモデルに対して自動評価が提供されます。モデル名またはを列からクリックすると、対応するモデルが表示されます。
Phrase Custom AIは、カスタムNextMTモデルの品質をより深く理解するために設計された、豊富なデータと高度な視覚的サポートを提供します:
-
タブには、MTモデルに関する直感的な視覚化とメタデータを備えた評価結果の要約が表示されます。
-
テーブルでは、4つのMT quality metricsを用いて、汎用NextMTモデルとカスタムNextMTモデルのパフォーマンスを比較します。テーブルには2つの主要なセクションがあります:
-
基準パフォーマンス
TMを活用しないPhrase NextMTおよびカスタムNextMTモデルの自動MT品質スコアを表示します。
-
RAGパフォーマンス
TMのファジーマッチを活用してMT出力を適応させた場合の自動MT品質スコアを表示します。
列は、各メトリックにおいて最高のパフォーマンスを示すモデルを強調表示します。
-
-
パネルには、評価されたカスタムNextMTモデルに関する重要な情報が提供されます。
-
-
タブでは、ドーナツチャートを用いてMT評価結果がグラフィカルに表示され、評価された翻訳セグメントが品質カテゴリごとに内訳されています。
-
上部のドロップダウンメニューから目的のMT品質メトリックを選択し、カスタムNextMTモデルと汎用Phrase NextMTモデルを比較します。
-
ドーナツチャートの各カテゴリにカーソルを合わせると、そのカテゴリの割合と影響を受けるセグメント数を確認できます。
-
-
タブには、評価セットから抽出されたセグメントサンプルのプレビューが表示され、関連するベースラインおよびRAGパフォーマンススコアとともにソースセグメントの一覧が示されます。
セグメントを選択すると、右側のパネルに以下が表示されます:
-
ベースラインおよびRAGパフォーマンスのセグメント固有のスコアと品質レベルインジケーター。
-
カスタムNextMTモデルと汎用NextMTモデルによって生成された翻訳出力と、データセットの参照翻訳との比較。を選択すると、参照翻訳との違いが強調表示されます。
-