論文 ·日本語 ·未確認

Document retrieval based on word's cooccurrences, the algorithum and its application.

Tsunenori Ishioka Masayuki Kameda

刊行年
1999-01-01
収録
『Ouyou toukeigaku』 28(2) pp. 107-121
言語
英語
openalex
W1983659178
doi
10.5023/jappstat.28.107
mag
1983659178
issn
0285-0370
URL
https://www.jstage.jst.go.jp/article/jappstat1971/28/2/28_2_107/_pdf

要旨

異なった文書に同時に現われる単語に着目することにより,潜在的な意味的検索をおこなうDeerwester(1990)のLatent Semantic Analysisを日本語の比較的大規模な文書集合に対して適用した.その中で,大型疎行列における特異値分解アルゴリズムの比較検討を行ない,日本語文書検索に適した方法を見つけた.これを実際の新聞記事で試し,文書検索,および関連語表示において有効であることの見通しを得た.また実装する上での工夫として,関連文書検索においては,文書の大きさによる基準化が必要なことがわかった.さらに,重複を許す単語のクラスタリングを試みた.

主題

この書誌の出所

  • openalex— W1983659178(2026-08-12取得)

引用キー: IshiokaKameda1999DocumentRetrievalBased

書誌 34,896件 語別索引 17,251件 資源 113件 研究者 303名 JSON