XMATヘルプページ|LDX lab

カスタム機械翻訳管理(用語集設定モデル詳細)

作成者: Admin|Jul 8, 2026 5:57:41 AM

用語集設定/用語集設定モデルとは

機械翻訳学習サービスの標準モデルや本システムで登録した追加学習モデルを用語集でラッピングすることで、用語集で定めた訳語を自動的に出力する処理を、本システムでは「用語集設定」と呼びます。一般的には「用語集ラッピング」と呼ばれることもあります。用語集設定の結果として作成されるのが用語集設定モデルです。用語集が設定されたモデルは、本システムのQuick MT/PEで利用できます。

サービス
利用方法 用語集設定モデル
Quick MT カスタム機械翻訳モデルの一覧で選択
Quick PE カスタム機械翻訳モデルの一覧で選択

用語集設定モデル詳細画面の見方

本画面には用語集設定モデルの詳細なデータが表示されます。変更できるのは以下の項目のみです。
  • 用語集設定モデル名:各モデルにつける任意の文字列。以下の箇所で表示されます。初期値は「用語集設定モデル_YYYYMMDDhhmmss」で、末尾の日時は用語集設定モデルの登録を開始したタイムスタンプです。(例:2022年2月1日15時20分40秒に開始した場合、「用語集設定モデル_20220201152040」)
    • Quick MT、Quick PE(プロジェクト管理画面)
      • 機械翻訳エンジン「Gooble Translate」:オプション項目 [用語集設定モデル] のプルダウンリスト
      • 機械翻訳エンジン「みんなの自動翻訳@KI」:標準項目 [汎用モデル/カスタム機械翻訳モデル] のプルダウンリスト
      • 機械翻訳エンジン「Amazon Translate」:オプション項目 [用語集設定モデル] のプルダウンリスト
  • モデルの有効状態:Quick MT/PEで利用するかどうか指定します。初期値は「有効」です。Quick MT/PEでの利用を許可しない用語集設定モデルについては「無効」に設定してください。
  • コメント:用語集設定モデルに関する任意の情報を追加できます。

また、画面下部には、用語集設定の際に使用した言語資産(用語集)の情報が表示されます。

 

用語集設定モデルのモデル評価

本画面では用語集設定モデルのモデル評価を実施することができます。画面下部の [モデル評価] ボタンを押すと、モデル評価に使用するバイリンガルファイル(原文-正解訳の対訳データ、ファイル形式:xliff、csv、tsv、最大50,000文字)をアップロードすることができます。

モデル評価の結果、以下の4つの指標が数値として算出され、以下のように用語集設定の前後での変化をご確認いただけます。左端は用語集設定に利用した機械翻訳学習サービスの標準モデル(汎用モデル)(※)の評価値、右端は用語集設定モデルの評価値です。追加学習モデルに対して用語集を設定した場合は、その追加学習モデルに対する評価値が中央に表示されます。BLUE、NIST、RIBESの3つは値が大きく、WERは値が小さく変化していると、追加学習によって効果的なカスタマイズが実施されたと解釈できます。各指標の詳しい意味についてはこちらのブログ記事でもご確認いただけます。

  • BLEU(ブルー)
  • NIST(ニスト)
  • RIBES(ライビーズ)
  • WER(ダブリュイーアール)

 

 

用語集内で重複する用語について

用語集には重複する用語(対訳)を登録することができますが、用語集として参照する場合でも、用語集設定モデルに組み込む場合でも、原文に対する訳文は一意とすることをお奨めします。ただし、以下のように、単語ごとの訳文と複合語の訳文を変えたいケースも考えられます。

英語
日本語
asset 資産
management 管理
asset management アセットマネジメント

このような対訳を含む用語集で用語集設定モデルを作成した場合、そのモデルを利用して原文(この場合は英文)を機械翻訳すると、原文の長さが長い用語が優先して訳文が採用されます。上記例の場合、原文に"asset management"が登場すると訳文としては「アセットマネジメント」が優先して採用されるため、この原文が「資産管理」と出力されることはありません。