論文 ·日本語 ·未確認
〈共同研究プロジェクト紹介〉萌芽・発掘型 : テキストの多様性を捉える分類指標の策定 書籍サンプルの文体を分類する
- 刊行年
- 2013-06
- 収録
- 『国語研プロジェクトレビュー』 4(1) pp. 43-53
- 出版
- 国立国語研究所
- crid
- 1390572174721322752
- naid
- http://ci.nii.ac.jp/naid/KJ00008505344
- uri
- https://repository.ninjal.ac.jp/records/739
- ndl_bib_id
- 025943003
- issn
- 2185-0100
- doi
- 10.15084/00000730
- URL
- https://cir.nii.ac.jp/crid/1390572174721322752
要旨
文体研究などへのコーパスの有効活用を図るため,コーパスの書籍サンプルを文体によって特徴づけることを目的に,書籍サンプルの分類指標の設計と付与を行った。対象はBCCWJ図書館サブコーパス収録の全10,551サンプルである。テキスト構造が単純(例:章節構造)なもの(全体の84%)については,内容・表現の文体的特徴により,専門度,客観度,硬度,くだけ度,および語りかけ性度,という5観点による分類指標を定め,主観的評定によって評価値を付与した。また,テキスト構造・紙面形式などの点で上記分類になじまないもの(全体の16%)を見出し,その特徴を表す別の指標を設定した。これらを通じて,図書館サブコーパスに収録される全サンプルの多種多様な形式の類型ごとの分布や,各類型のNDC ごとの頻度が明らかになった。
この書誌の出所
- cinii— 1390572174721322752(2026-08-13取得)
引用キー: 柏野2013〈共同研究プロジェク