論文 ·日本語 ·未確認
小規模誤りデータからの日本語学習者作文の助詞誤り訂正
今村 賢治 ・ 齋藤 邦子 ・ 貞光 九月 ・ 西川 仁 ・ Kenji Imamura ・ Kuniko Saito ・ Kugatsu Sadamitsu ・ Hitoshi Nishikawa
- 刊行年
- 2012
- 収録
- 『自然言語処理』 19(5) pp. 381-400
- 言語
- 日本語・英語
- doi
- 10.5715/jnlp.19.381
- issn
- 1340-7619
- jstage_journal
- jnlp
- openalex
- W2323747749
- mag
- 2323747749
- URL
- https://www.jstage.jst.go.jp/article/jnlp/19/5/19_381/_article/-char/ja/
要旨
本稿では,置換,挿入,削除操作を行う識別的系列変換で日本語学習者作文の助詞誤りを自動訂正する.誤り訂正タスクの場合,難しいのは大規模な学習者作文コーパスを集めることである.この問題を,識別学習の枠組み上で 2 つの方法を用いて解決を図る.一つは日本語としての正しさを測るため,少量の学習者作文から獲得した n-gram 二値素性と,大規模コーパスから獲得した言語モデル確率を併用する.もう一つは学習者作文コーパスへの直接的補強として,自動生成した疑似誤り文を訓練コーパスに追加する.さらに疑似誤り文をソースドメイン,実際の学習者作文をターゲットドメインとしたドメイン適応を行う.実験では,n-gram 二値素性と言語モデル確率を併用することで再現率の向上ができ,疑似誤り文をドメイン適応することにより安定した精度向上ができた.
主題
この書誌の出所
- jstage— 10.5715/jnlp.19.381(2026-08-12取得)
- openalex— W2323747749(2026-08-12取得)
引用キー: 今村2012小規模誤りデタからの