論文 ·日本語 ·未確認

A Framework of Integrating Syntactic and Lexical Statistics in Statistical Parsing

Kiyoaki Shirai Kentaro Inui Takenobu Tokunaga Hozumi Tanaka

刊行年
1998-01-01
収録
『Journal of Natural Language Processing』 5(3) pp. 85-106
言語
英語
openalex
W2047126765
doi
10.5715/jnlp.5.3_85
mag
2047126765
issn
1340-7619
URL
https://www.jstage.jst.go.jp/article/jnlp1994/5/3/5_3_85/_pdf

要旨

本論文では, 構文解析の曖昧性解消を行うために, 構文的な統計情報と語彙的な統計情報を統合する手法を提案する. 我々が提案する統合的確率言語モデルは, 構文的優先度などの構文的な統計情報を反映する構文モデルと, 単語の出現頻度や単語の共起関係などの語彙的な統計情報を反映する語彙モデルの2つの下位モデルから成る. この統合的確率言語モデルは, 構文的な統計情報と語彙的な統計情報を同時に学習する過去の多くのモデルと異なり, 両者を個別に学習する点に特徴がある. 構文的な統計情報と語彙的な統計情報を独立に取り扱うことにより, それぞれの統計情報を異なる言語資源から独立に学習することができるだけでなく, それぞれの統計情報が曖昧性解消においてどのような効果を果たすのかを容易に分析することができる. この統合的確率言語モデルを評価するために, 日本語文の文節の係り受け解析を行った. 構文モデルを用いたときの文節の正解率は73.38%となり, ベースラインに比べて11.70%向上した. また, 構文モデルと語彙モデルを組み合わせることにより, 文節の正解率はさらに10.96%向上し84.34%となった. この結果, 本研究で提案する枠組において, 語彙的な統計情報は構文的な統計情報と同程度に曖昧性解消に貢献することを確認した.

主題

この書誌の出所

  • openalex— W2047126765(2026-08-12取得)

引用キー: Shirai1998FrameworkIntegratingSyntactic

書誌 34,896件 語別索引 17,251件 資源 113件 研究者 303名 JSON