論文 ·日本語 ·未確認

小規模誤りデータからの日本語学習者作文の助詞誤り訂正

今村 賢治 齋藤 邦子 貞光 九月 西川 仁 Kenji Imamura Kuniko Saito Kugatsu Sadamitsu Hitoshi Nishikawa

刊行年
2012
収録
『自然言語処理』 19(5) pp. 381-400
言語
日本語・英語
doi
10.5715/jnlp.19.381
issn
1340-7619
jstage_journal
jnlp
openalex
W2323747749
mag
2323747749
URL
https://www.jstage.jst.go.jp/article/jnlp/19/5/19_381/_article/-char/ja/

要旨

本稿では,置換,挿入,削除操作を行う識別的系列変換で日本語学習者作文の助詞誤りを自動訂正する.誤り訂正タスクの場合,難しいのは大規模な学習者作文コーパスを集めることである.この問題を,識別学習の枠組み上で 2 つの方法を用いて解決を図る.一つは日本語としての正しさを測るため,少量の学習者作文から獲得した n-gram 二値素性と,大規模コーパスから獲得した言語モデル確率を併用する.もう一つは学習者作文コーパスへの直接的補強として,自動生成した疑似誤り文を訓練コーパスに追加する.さらに疑似誤り文をソースドメイン,実際の学習者作文をターゲットドメインとしたドメイン適応を行う.実験では,n-gram 二値素性と言語モデル確率を併用することで再現率の向上ができ,疑似誤り文をドメイン適応することにより安定した精度向上ができた.

主題

この書誌の出所

  • jstage— 10.5715/jnlp.19.381(2026-08-12取得)
  • openalex— W2323747749(2026-08-12取得)

引用キー: 今村2012小規模誤りデタからの

書誌 34,896件 語別索引 17,251件 資源 113件 研究者 303名 JSON