本文へ移動

論文 ·日本語 ·未確認

日本語諸方言の形態素解析用辞書の構築と活用

坂井 美日 ・ 中澤 光平 ・ 村上 謙 ・ 小木曽 智信 ・ 五十嵐 陽介 ・ 宮川 創 ・ 久保薗 愛 ・ 中川 奈津子 ・ 小西 いずみ ・ 平子 達也 ・ 近藤 明日子 ・ 大槻 知世

CiNii CRID
1040014327101435008
科研費
23H00007
jgn
JP23H00007
URI
https://kaken.nii.ac.jp/grant/KAKENHI-PROJECT-23H00007/
URL
https://cir.nii.ac.jp/crid/1040014327101435008

要旨

国立国語研究所で開発を行ってきた電子化辞書UniDicをもとに、日本各地の方言の書き起こしテキストの高精度な解析を可能にする形態素解析用の辞書群を開発する。各辞書の構築にあたっては、標準語用・歴史用の辞書と解析単位・見出し基準を可能な限り統一し、各時代・各地方の言語のコーパスを相互に比較可能にする。構築した形態素解析用の辞書はオンラインで公開するほか、ツール「Web茶まめ」を通してだれもが簡単に利用できる形で提供する。

主題

この書誌の出所

  • cinii— 1040014327101435008(2026-08-12取得)

引用

坂井 美日・中澤 光平・村上 謙・小木曽 智信・五十嵐 陽介・宮川 創・久保薗 愛・中川 奈津子・小西 いずみ・平子 達也・近藤 明日子・大槻 知世 日本語諸方言の形態素解析用辞書の構築と活用

坂井日本語諸方言の形態素
書誌 67,320件 語別索引 17,251件 資源 113件 研究者 303名 JSON