論文 ·日本語 ·未確認

日英特許コーパスからの専門用語対訳辞書の自動獲得

下畑 さより 井佐原 均 Sayori Shimohata Hitoshi Isahara

刊行年
2007
収録
『自然言語処理』 14(4) pp. 23-41
言語
日本語・英語
doi
10.5715/jnlp.14.4_23
issn
1340-7619
jstage_journal
jnlp1994
openalex
W2319833934
mag
2319833934
URL
https://www.jstage.jst.go.jp/article/jnlp1994/14/4/14_4_23/_article/-char/ja/

要旨

本論文では, 日英特許コーパスを用いて専門用語の対訳辞書を作成する方法について述べる.提案手法は, 言語単位としての妥当性と分野による出現の偏りを数値化することで, コーパス中の単語 (列) を専門用語として抽出し, 和英辞書などの既知の対訳用語セット (seed wordリスト) を介して, コーパスにおける各専門用語の共起パターンを計測し, その類似性が高い用語ペアを対訳として対応付ける.この時, 対象となるコーパス間で文脈が類似している対訳のみをseed wordに利用する点が特徴である.本手法を日本語特許抄録とその英訳に適用したところ, 専門用語の抽出精度は日本語で90%, 英語で93%となった.また, 訳語対応付けでは, 各専門用語の対訳として1位に対応付けられた対訳候補の正解率が53% (日英) と66% (英日), 10位以内に対応付けられた対訳候補の正解率が83% (日英) と90% (英日) と, 従来研究と比べて高い精度を得ることができた.本論文ではさらに, PAJの日本語抄録と米国特許抄録を用いた実験を行い, コーパスの違いによる実験結果の違いについても考察する.

主題

この書誌の出所

  • jstage— 10.5715/jnlp.14.4_23(2026-08-12取得)
  • openalex— W2319833934(2026-08-12取得)

引用キー: 下畑2007日英特許コパスからの

書誌 34,896件 語別索引 17,251件 資源 113件 研究者 303名 JSON