論文 ·日本語 ·未確認
Document retrieval based on word's cooccurrences, the algorithum and its application.
Tsunenori Ishioka ・ Masayuki Kameda
- 刊行年
- 1999-01-01
- 収録
- 『Ouyou toukeigaku』 28(2) pp. 107-121
- 言語
- 英語
- openalex
- W1983659178
- doi
- 10.5023/jappstat.28.107
- mag
- 1983659178
- issn
- 0285-0370
- URL
- https://www.jstage.jst.go.jp/article/jappstat1971/28/2/28_2_107/_pdf
要旨
異なった文書に同時に現われる単語に着目することにより,潜在的な意味的検索をおこなうDeerwester(1990)のLatent Semantic Analysisを日本語の比較的大規模な文書集合に対して適用した.その中で,大型疎行列における特異値分解アルゴリズムの比較検討を行ない,日本語文書検索に適した方法を見つけた.これを実際の新聞記事で試し,文書検索,および関連語表示において有効であることの見通しを得た.また実装する上での工夫として,関連文書検索においては,文書の大きさによる基準化が必要なことがわかった.さらに,重複を許す単語のクラスタリングを試みた.
主題
この書誌の出所
- openalex— W1983659178(2026-08-12取得)
引用キー: IshiokaKameda1999DocumentRetrievalBased