IN STUDIES · ISSUE 049

(仮ビジュアル)暗い室内で黒い壁ぎわに立ち、隣の窓ガラスに自分の後ろ姿が映りこんでいる、黒いニットの女性。窓の外は夕暮れの空● 12 SEC
Visual: ALIFE Editorial

「能力は伸びる」と信じましょう——この助言には、教材として都合のよい性質が三つあります。配るのに費用がかからない。1時間もかからない。効いたかどうかを、受けた本人に聞いて測れる。だから、たくさん配られ、たくさん測られてきました。2023年、無作為化された介入63件・97,672人を集め直した分析は、学業成績への平均効果を d = 0.05 と報告しています。

この号が想定しているのは学生ではなく、いま何かを覚えなければならない大人です。資格の勉強、仕事のための技術書、語学のやり直し、子どもの宿題。学業群16号の最初にあたるこの号が扱うのは一点だけ——「能力は伸びる」という信念が、どこまで測られてきたのかです。信じ方の指導も、成績を上げる手順も配りません。

成長マインドセット(Growth Mindset)とは、知能や能力は努力や学び方で伸ばせる、という信念のこと。測られてきたのは二つです。信念そのもの——質問紙に答えてもらって数値にします。そして、その信念を変えようとする介入の効果——多くは1時間に満たない教材で、成績はその学期のうちに見ます。どちらも測るのが速く、安い。半年後にその信念がどこにあるかを追った研究は、ほとんどありません。

(仮ビジュアル)洗面台の黒枠の鏡に映る自分と向き合う女性。台には赤いガラスのカップと黒い本が置かれている
測られてきたのは、質問紙で答えた信念と、1時間に満たない教材の効果。 Visual: ALIFE

その二つが、どこまで持ちこたえたのか。まず測られたのは、この3本です。

01学業成績への平均は、0.05だった。2023年、無作為化された介入63件・97,672人を集め直した分析。学業成績への平均は d = 0.05(95%信頼区間 0.02〜0.09)で、出版バイアスを補正すると有意ではなくなりました。設計の質が最も高い6件(13,571人)で 0.02(−0.06〜0.10)、信念が動いたと確認できた13件(18,355人)で 0.04(−0.01〜0.10)——どちらも0をまたぎます。公刊分は、著者に金銭的な利害があると 0.18、無いと −0.10。未公刊だけなら順に 0.02 と 0.05 で、差は消えました。

02争点は、平均の取り方だと応答した。批判は、そのまま結論にはなりませんでした。同じ号に、提唱者側の応答が並んでいます。反論は「効果が無い」ではなく「平均の取り方が違う」——ばらつき(異質性)を扱わずに、小さな便宜的標本と大規模試験を同じ重みで平均すれば、差のある場所が潰れるから。応答側の再集計値は、原典の全文まで確認できていないため出しません。別の査読論文は、大規模試験の中にも下位層の成績が動かなかった学校があったと認める一方、質の低い介入と高い介入を混ぜることには反対しています。

03別の国での追試では、再現しなかった。2019年、中国の9歳から13歳の児童624人を対象にした追試。古典的な操作を3つの研究で試しましたが、失敗のあとの粘りにも、学期をまたいだ成績にも、効果は出ませんでした。著者たちは、能力が変えられるという信念は、失敗への耐性とも学校での伸びとも結びついていないかもしれない、と結んでいます。ただし1本の追試であり、効果が無いと確定させるものではありません。

(仮ビジュアル)ベージュの空間で、黒い石の天板を、灰色のガラス・銀の金属・赤い漆という3本の異なる脚が支えているコンソールテーブル
63件・97,672人の平均、同じ号に載った応答、児童624人の追試。まず測られたのは、この3本。 Visual: ALIFE

ここから先で、話はよく別のものへ入れ替わります。落ちるのは、誰について・どの条件で・どれだけ、の三つです。

01年号のない一文で、話している。学習の資料には「困難な移行期の成績低下を防ぐ」という一文がよく載り、代表文献は一般向けの書籍です。一般向けの本に効果量は載りません。出発点は2007年の米国の研究で、中学1年にあたる学年の373人を2年間追った縦断研究と、介入群48人・対照群43人の実験が1本になったもの。実際に動かしたほうは合計91人。縦断研究は観察であって、信念が成績を動かしたと示したものではありません。

02相関の強さを、介入の効果として読んでいる。人と人を並べたときの差(相関)と、介入の前後で動いた量(効果量)は、同じことを測っていません。2020年、米国の大学生438人で理論の前提を検証した研究では、信念と、目標の持ち方・努力についての考え・失敗への反応との相関はすべて .20 を下回り、いちばん強かった r = −.12 は理論の予測とは逆の向きでした。相関が小さくても効果がゼロだとは言えず、大きくても介入で動くとは限りません。

03限られた層の結果を、全体へ広げている。効果が報告されてきたのは、多くの場合特定の層——成績が下位の層や、経済的に不利な家庭の生徒——でした。特定の層で数字が出たことは、その層の外にいる人の判断材料にはなりません。そして、伸びしろが残っている側で数字が出たとも、いま届いていない支援の代わりに信念が配られた結果とも読めます。どちらに読むかは、この文献群では決められません——というのが、この号の読み筋です。

(仮ビジュアル)縦に3分割された写真。左は乱れた寝具のベッド、中央は窓の外へ目を向ける女性、右は玄関の床に脱ぎ置かれたコートと鍵
年号のない一文・相関と介入の取り違え・限られた層の拡張。ずれは、読み方のほうに出る。 Visual: ALIFE

三つを並べると、言えることの形が見えます。無作為化された63件・97,672人の平均は、学業成績について d = 0.05。設計の質を絞るほど点は0に近づき、信頼区間は0をまたぎました。提唱者側は、その平均の取り方が違うと反論しています。別の国での追試は再現しませんでした。

確定しているのは、どちらか一方の推定ではなく、推定が方法の選び方で動くという事実のほうです。対象は主に欧米と中国の児童・生徒と大学生。働きながら学ぶ大人の研究はごく少なく、日本の大人を対象にした追試は見あたりません。測定の多くは自己報告で、期間も短いものが中心です。

学業成績への平均は、0.05だった。
その平均の取り方が、いま争われている。

ここまでの数字は、「能力は伸びる」と信じることを捨てる理由にはなりません。支えが弱いと分かったのは、信じ方の指導が学業成績を大きく動かすという主張のほうです。次の3手も、研究が命じた順番ではありません。信念そのものではなく、判断の根拠のほうを見に行く——ALIFEが提案する、実践の入口です。

TRY IT TODAY

  1. 01PICK

    いま「できない」「向いていない」と思っている課題を、1つだけ書き出す。

  2. 02DATE

    その下に、最後にそれを実際に試したのがいつだったかを書く。

  3. 03READ

    全体を一度だけ読み返す。試していなければ「試していない」で十分。

5分。**採点はありません。**その課題に取りかかる必要も、答えを出す必要もありません。書くのは最後に試した時期だけで、思い出せなければ「覚えていない」でかまいません。いま学校に通っていない人は、仕事で避けている作業に置き換えてかまいません。誰にも見せなくてよく、書いた紙は処分してかまいません。頭の中だけで行っても成立します。つらくなったらそこで中止し、つらさが続く・強まる場合は医療・支援の専門家へ相談してください。

この説がこれだけ生き延びたのは、外れていたからではなく、測るのが安かったから——というのが、この号の読み筋です。信念が変わったかは質問紙でその場で分かり、成績が変わったかは年度末まで待たないと分かりません。だから前者ばかりが積み上がり、引用のたびに但し書きが落ちて、最後には年号のない一文になります。

0.05 は、学校で測られた介入の平均であって、人の可能性の大きさを測った数字ではありません。学業群の16号は、机に向かうまでの道具(049〜052)、頭の中で情報を動かす道具(053〜056)、点検して並べ替える道具(057〜059)、続ける・広げるための道具(060〜064)という順に並びます。次の050「自己効力感」で扱うのは、能力一般についての考えではなく、目の前の一問についての予想のほうです。

SECOND LAYER · FULL SYLLABUS成長マインドセットを、もっと深く学ぶ。→
HOW TO READ THE NUMBERS数字の読み方

この号に出てくる統計の言葉です。数値は原典のまま、意味だけをほどいています。

効果量
差や関連の「大きさ」を、単位の違う研究どうしでも比べられるようにした共通の物差し。「効果があるか」ではなく「どれくらいか」を表します。
相関係数 r
2つのものが連動する強さ。−1〜+1で、0は関連なし。一般的な目安では ±.10=弱い、±.30=中くらい、±.50=強い関連とされます。関連があっても、原因と結果の関係とは限りません。
効果量 d・g
2つのグループの平均の差を、ばらつきの大きさで割った値。一般的な目安では 0.2=小、0.5=中、0.8=大。g は d を小規模研究向けに補正したものです。
95%信頼区間
推定値の「ばらつきを見込んだ幅」。同じ研究を何度もやり直したら、結果の多くがこの幅に収まると期待できます。幅が0(差なし)をまたぐときは、明確な差とは言い切れません。
無作為化比較試験
くじ引きの要領で「介入を受ける群」と「受けない群」に分けて比べる実験。「効いたかどうか」を言うための標準的な設計です。
観察研究・前向き研究
介入せずに経過を追いかける研究。「関連がある」までは言えますが、「それが原因だ」とは言い切れません。
統計的に有意
「偶然だけでは説明しにくい」という意味の専門用語。効果が大きい・重要だという意味ではありません。ごく小さな差でも、人数が多ければ有意になります。
出版バイアス
「効果が出た」研究ほど論文として世に出やすい偏り。これがあると、統合した平均値が実際より大きく見えます。

Next in studies

VIEW ALL
ISSUE 048家族の食事の関連は、厳しく比べると縮んだ。ISSUE 050値が動いたのは、測り方のほうだった。
ALIFE · ISSUE 049

本コンテンツは学習目的であり、診断や治療の代替ではありません。