論文 ·日本語 ·未確認

Multi-domain Adaptation for Statistical Machine Translation Based on Feature Augmentation

Kenji Imamura Eiichiro Sumita

刊行年
2017-01-01
収録
『Journal of Natural Language Processing』 24(4) pp. 597-618
言語
英語
openalex
W2771369142
doi
10.5715/jnlp.24.597
mag
2771369142
issn
1340-7619
URL
https://www.jstage.jst.go.jp/article/jnlp/24/4/24_597/_pdf

要旨

ドメイン適応は,機械翻訳を実用に使用するときの大きな課題の一つである.本稿では,複数ドメインを前提とした,統計翻訳の適応方式を提案する.本稿の方式は,カバレッジが広い(未知語が少ない)コーパス結合モデルと,素性関数の精度がよい単独ドメインモデルを併用する.これらを,機械学習のドメイン適応に用いられている素性空間拡張法の考え方で結合する.従来の機械翻訳における素性空間拡張法は,単一のモデルを用いていたが,本稿の提案方式は,複数のモデルを用いることにより,両者の利点を活かすことが特徴である.実験では,単独ドメインモデルに比べ,翻訳品質が向上または同等を保持した.提案法は,当該ドメインの訓練コーパスが小規模である場合に高い効果を持ち,100 万文規模の大規模コーパスを持つドメインへの適応に使用しても,翻訳品質を下げることなく,ドメインによっては品質向上の効果がある.基本的な対数線形モデルでも,モデルの選択と設定を適切に行うことで,最先端品質の適応方式が実現できることを示す.

主題

この書誌の出所

  • openalex— W2771369142(2026-08-12取得)

引用キー: ImamuraSumita2017MultiDomainAdaptation

書誌 34,896件 語別索引 17,251件 資源 113件 研究者 303名 JSON