本文へ移動

論文 ·日本語 ·未確認

自動獲得した未知語の読み・文脈情報による仮名漢字変換

笹田 鉄郎 ・ 森 信介 ・ 河原 達也 ・ Tetsuro Sasada ・ Shinsuke Mori ・ Tatsuya Kawahara

刊行年
2010
収録
『自然言語処理』 17(4) pp. 4_131-4_153
言語
日本語・英語
DOI
10.5715/jnlp.17.4_131
ISSN
1340-7619
J-STAGE
jnlp
OpenAlex
W2319565262
MAG
2319565262
URL
https://www.jstage.jst.go.jp/article/jnlp/17/4/17_4_4_131/_article/-char/ja/

要旨

未知語の問題は,仮名漢字変換における重要な課題の 1 つである.本論文では,内容の類似したテキストと音声から未知語の読み・文脈情報をコーパスとして自動獲得し,仮名漢字変換の精度向上に利用する手法を提案する.まず,確率的な単語分割によって未知語の候補となる単語をテキストから抽出する.次に,各未知語候補の読みを複数推定して列挙する.その後,テキストに類似した内容の音声を認識させることによって正しい読みを選択する.最後に,音声認識結果を学習コーパスとみなして仮名漢字変換のモデルを構築する.自動収集されたニュース記事とニュース音声を用いた実験では,獲得した未知語の読み・文脈情報を仮名漢字変換のための学習コーパスとして用いることで,精度が向上することを確認した.

主題

この書誌の出所

  • jstage— 10.5715/jnlp.17.4_131(2026-08-12取得)
  • openalex— W2319565262(2026-08-13取得)

引用

笹田 鉄郎・森 信介・河原 達也・Tetsuro Sasada・Shinsuke Mori・Tatsuya Kawahara(2010) 自動獲得した未知語の読み・文脈情報による仮名漢字変換 『自然言語処理』 17(4) pp. 4_131-4_153

笹田2010自動獲得した未知語の
書誌 67,320件 語別索引 17,251件 資源 113件 研究者 303名 JSON