論文 ·日本語 ·未確認

Composite Term Extraction from Japanese Texts

Teruo Koyama

刊行年
2010-01-01
収録
『Joho Chishiki Gakkaishi』 19(4) pp. 306-315
出版
Japan Society of Information and Knowledge
言語
英語
openalex
W2036036468
doi
10.2964/jsik.19_306
mag
2036036468
issn
0917-1436
URL
https://www.jstage.jst.go.jp/article/jsik/19/4/19_19_306/_pdf

要旨

用語は研究成果を記述するために用いられる言語記号であり,研究成果の記述された文献を高度利用し,研究のさらなる発展を期する上で重要な役割を担うものである.本論文では,日本語研究文献テキストから,自然言語処理技術を応用した手法により用語候補を機械的に抽出するための方法について論じる.日本語では多くの用語は語幹レベルでの複合語として出現するが,現在の形態素分類に従う複合語抽出をそのまま適用するのでは,再現率を保ちつつ用語抽出の適合率を高めることは容易ではない.本研究では,抽出対象となる複合語の内部構造と,テキスト内での複合語の前後に対する接続関係に制約を設けることにより,適合率を下げることなく多くの複合語用語候補を抽出することが可能となることを示す.また,抽出された複合語用語候補について,候補間に成立する入れ子関係や候補が関連すると考えられる部分研究テーマの側面から整理し,体系化する試みについて述べる.

主題

この書誌の出所

  • openalex— W2036036468(2026-08-13取得)

引用キー: Koyama2010CompositeTermExtraction

書誌 56,535件 語別索引 17,251件 資源 113件 研究者 303名 JSON