IN STUDIES · ISSUE 055
● 12 SEC「3歳までに、3,000万語の差がつく」。教育の資料で、これほど広く配られた数字はありません。出どころは特定できます。米国の縦断観察を、著者たち自身が2003年に一般向けにまとめた記事です。設計は、最後まで残った標本42家庭を、月1回1時間ずつ、2年半以上観察したというもの。報告された1時間あたりの語数を4年分に引き伸ばし、およそ1,300万語・2,600万語・4,500万語が示されました。
この号が扱うのは二つだけです。文章を読むのに語がどれだけ要るのかと、あの数字がどう作られ、いまどうなっているのか。語彙を増やす手順も、家庭の語りかけの理想像も配りません。扱うのは数字の作られ方であって、家庭や個人の優劣ではありません。
言語能力(Verbal Ability)とは、言葉を受け取り、組み立て、使う力の総称です。ただし研究がおもに数えてきたのは、数えやすい二つでした。読んでいる文章のうち意味の取れる語の割合——被覆率。そして幼いころに浴びた語の量——1時間あたり何語か。どちらも言語能力そのものではなく、外から数えられる代理の指標です。

まず被覆率のほうから。この割合が、どこまで測られたのか。まず測られたのは、この3つです。
01割合を4段階にした、66人の実験。2000年の実験は、既知語の割合が100%・95%・90%・80%の4種類の版を作り、ニュージーランドの大学生66人に読ませたと報告されています。80%では十分に理解できた人はおらず、90%でもごくわずか、95%でも過半数に届かなかった。著者たちは、助けなしで読むのに要る割合を、当時よく言われた95%ではなく98%=50語に1語しか知らない語が無い状態、と見積もりました。原典の全文までは未確認のため、報告の帰属にとどめます。
02104人での再現では、完全には再現されなかった。2023年、この実験を再現する研究が公表されました。対象は学術的な文脈の外にいるスリランカの成人学習者104人。語彙水準テストと未知語密度を変えた読解課題での結果は、もとの研究の知見を完全には再現できなかった。「98%は嘘だった」ではなく、「66人の大学生で得た敷居が、別の学習者にそのまま当てはまるとは限らない」です。
03要る語数と、教われる語数は桁が違う。2006年の分析は、英語の大規模な資料集を1,000語族ずつに分け、98%の被覆にはおよそ、書き言葉で8,000〜9,000語族、話し言葉で6,000〜7,000語族が要ると見積もりました(語族=原形と派生形をまとめた単位)。1984年の推定は、米国の学校の印刷物におよそ88,500語があるとし、直接教える方式だけでは実際に覚える語の意味のある割合を説明できず、読み物で出会う語のわずかしかまかなえないと結論。差を埋めるのは読むことによる取り込みで、語彙は度合いとして育つ——この号の読み筋です。

ここから先で、数字はよく別のものへ入れ替わります。手がかりは3つ。
01引き伸ばした値を、観察した値として読んでいる。「3,000万語」の設計は、著者たち自身が2003年にまとめた記事にあります。最後まで残った標本は42家庭。職業をもとに、上位の社会経済層13・中位10・下位13・公的扶助6。各家庭を月1回1時間ずつ、2年半以上観察し、1時間あたりの語数は公的扶助616語・働いている家庭1,251語・専門職2,153語(語数が示されたのはこの三区分)。記事はこれを4年分に引き伸ばし、およそ1,300万語・2,600万語・4,500万語を示しました。その差が「3,000万語」。月1回1時間の記録が起きているあいだ全部の代理になっており、低いほうの端は6家庭ぶんです。
02決着していない論争の、片側だけを引いている。2019年、別の標本で試した研究が出ます。米国の5つの地域の、18か月から48か月の子ども42人の言語環境を、民族誌的な観察と縦断的な記録で調べたもの。結論は三つ——もとの主張は支持されなかった。各層の内側の変動が大きかった。複数の養育者や、その場の大人どうしの会話を除く定義は、収入の低い家庭の子どもが浴びる語数を不釣り合いに小さく見積もる。いっぽう、同じ雑誌の同じ年に、提唱者側の応答も載っています。応答は「収入の低い家庭の親はみな十分に話していないという欠損の見方は支持しない」と明言したうえで、批判側の設計に高学歴の群が無いこと、その場で聞こえる会話と子どもに向けられた会話は同じ働きをしないことを挙げました。三つは並んだままで、どちらか一方を結論に引ける状態にはありません。
03英語で採られた数字を、そのまま持ち帰っている。98%も、8,000〜9,000語族も、88,500語も、英語について採られた推定です。日本語の読解にそのまま当てはめられる値ではありません。対象もニュージーランドの大学生・スリランカの成人学習者・米国の児童に偏り、働きながら学ぶ大人の研究はごく少ない。実験室の課題と、実際に本や資料を読む場面も別物です。そして、読む時間の取れる人ほどその方法を試せるという逆向きを、この種の研究は排除できません。

並べると、この号が言えることの形が見えます。既知語の割合を下げると理解が崩れたという報告があり、その敷居の見積もりは別の学習者では完全には再現されなかった。要る語数は、直接教える方式でまかなえる量と桁が合わない。語彙の差がどこで開くのかを説明したとされてきた数字のほうは、いまも決着していない。
時間の側の報告も一本。1997年の米国の縦断研究は、1年生のときに測った読みの力が、10年後の11年生の読解・語彙・一般知識をいずれも予測したと報告しました。認知能力の指標を統計的に取り除いてもこの関係は残り、活字に触れる量は11年生の読解力を取り除いてもなお成果と結びついていました。これは観察された予測であって、宣告ではありません。
児童を対象にした研究で、大人でも同じかは別に確かめる必要があります。分からなかった日にまず見るのは、読み方ではなく材料の側——研究が命じた順番ではなく、この号の読み筋です。
引き伸ばす前の観察は、月1回1時間。
測り直した側と応答した側は、まだ並んでいる。
だから、読めなかった文章を読解力の不足として数える必要はありません。次の3手も、研究が命じた順番ではなく、材料の側から確かめるためにALIFEが置いた入口です。
TRY IT TODAY
- 01PICK
今日読んだ文章から、段落を1つ選ぶ。技術書でも説明書でもよい。
- 02MARK
意味が取れなかった語に印を付けて、その数を数える。
- 03CONVERT
段落のおよその語数で割り、100語あたり何語かを概算して記録する。
言語能力は、語彙を増やす速さの話ではありません。助けなしで読むのに語がどれだけ要るのか、その見積もりがどこから来たのかを見分ける話です。98%という敷居は、ニュージーランドの大学生66人の実験の見積もりとして報告され、スリランカの成人学習者104人での再現では完全には再現されませんでした。
3,000万語は、42家庭を月1回1時間ずつ観察した値を4年分に引き伸ばした数字で、測り直した側と応答した側は同じ雑誌の同じ年に並んだまま、決着していません。推定はいずれも英語圏の学習者と米国の児童に偏っています。——今日数えられるのは、選んだ段落のおよその語数と、意味が取れなかった語の数と、100語あたりに直した概算値。その三つだけです。
SECOND LAYER · FULL SYLLABUS言語能力を、もっと深く学ぶ。→HOW TO READ THE NUMBERS数字の読み方+
この号に出てくる統計の言葉です。数値は原典のまま、意味だけをほどいています。
- 観察研究・前向き研究
- 介入せずに経過を追いかける研究。「関連がある」までは言えますが、「それが原因だ」とは言い切れません。