IN LEARNING & GROWTH · ISSUE 193

(仮ビジュアル)暗い部屋の黒い壁ぎわに黒いニットで立つ女性。すぐ隣の窓ガラスに、その後ろ姿と夕暮れの空が映り込んでいる● 12 SEC
Visual: ALIFE Editorial

2016年9月から2017年2月まで、イングランドで行われた効果検証があります。小学校101校を学校ごと無作為に、実施50校と比べる側51校へ(6年生5,018人)。実施側では教師が短い研修を受け、8週にわたって毎週1回、「頭の良さは努力で伸びる」という授業を行います。

全国共通試験で見た効果は、算数 −0.01(95%信頼区間〔推定値が入りやすい幅〕−0.04〜0.01、4,454人)、読解 −0.00(4,437人)、文法・句読点・綴り −0.00(4,448人)。3つとも「0か月分の進捗」。報告書自身が、理由の候補を書きます——"Most teachers in the comparison schools … were familiar with this, and over a third reported that they had attended training days"(比べる側の教師の多くがこれを知り、3分の1超が研修日に参加したと答えた)。

逆側の但し書きも、同じ報告書にあります——"few said they had used these within their own teaching practices"(自分の授業で使ったと答えた人は少なかった)。確度評価は「高い」のまま(脱落率は主要指標で約11%、副次で40%超)。この号が見るのは、どの段で、誰に、どれだけ測られたか、です。

成長マインドセットは、ふつう個人の信念として紹介されます。この号は、提唱者の本には到達していません。定義は書かず、読んだ研究の測り方を書きます。2020年の組織研究では、たった2項目——「才能の量は決まっていて、変えるためにできることはあまり無い」への同意です。

研究は、測る先を段に分けています。2023年の分析は信念・やる気・行動・成果の4段で集計し、成果の段は学業成績・心の健康・社会的な機能に分かれます。著者の公開データを組み直して再現すると、信念の段 0.457 に対し学業成績の段は 0.0872(四捨五入して0.09、95%信頼区間 0.05〜0.13)。どの段かで、残る値の大きさが違う(印字値ではなく再現値です)。

8点のうち無作為の割り付けがあるのは4か所——米国の試験(生徒ひとりずつ)、英国の検証(学校ごと)、2020年の研究2(理念文を読ませる)、2005年の研究4(短い訓練)。そこだけ「〜になった」と書き、あとは「そう答えられていた」で止めます。

(仮ビジュアル)薄暗い部屋の黒枠の大きな鏡の前で、黒いローブ姿の女性が鏡に映った自分と静かに向き合っている写真
信念の段と、成果の段。同じ研究の中で、残る値の大きさが違う。 Visual: ALIFE

まず測られたのは、この3本です。

01無作為化設計の53標本を集めた分析。段ごとに、残る値の大きさが変わった。2023年の分析は、2002年から2020年末までの無作為化設計の研究から53の独立した標本を集めました。効果が見込みやすい層かつ実施の質が高い条件で、学業成績 0.14(0.06〜0.22)・心の健康 0.32(0.10〜0.54)。社会的な機能は文献が成熟せず条件を絞れないため、単純平均で 0.36(0.03〜0.68)。種類が違うので、ラベルが要ります。次の1本で見込まれる幅は学業 −0.08〜0.35、心の健康 0.07〜0.57、社会的機能 −0.50〜1.22。下端はマイナスに落ちています。

02同じ「無作為に割り付けた」でも、米国の65校と英国の101校では測った先が違う。米国。公立高校65校の9年生12,490人を、生徒ひとりずつ割り付けました。校内で下位の層では、6,320人で学年末の主要4教科の評定平均が0.10点上がり(0.04〜0.16)、上位の6,170人では明確な差とは言えません(P = 0.634)。全米への推定では、評定2.0未満が46%から41%へ(5.3ポイント、相対11%減)。差が大きいのは、挑戦を選ぶことが周りに支えられた学校です。上位の数学の履修率は逆で、3ポイント増(33%→36%、6,690人)は学力の高い学校のほうが大きく、上位25%の学校で4ポイント、下の75%で2ポイント。原典の結びは"an exclusive focus on GPA would have obscured intervention benefits"(評定だけを見ていたら見落としていた)。ただし探索的分析です。英国。非認知の4尺度でも、無償給食の対象でも、女子でも男子でも、証拠はありませんでした。

03会社で測った数少ない一本。結びついていたのは、会社をどう見ているかだった。2020年の研究は3つ。研究1は2013年の米国の大企業500社の理念文を伏せ字で採点し、433社で、固定寄りの会社ほど文化への満足が低い(p=.007)。研究2(ここだけ無作為割り付け)は成人207人に理念文6本のどれかを読ませ、固定寄りを読んだ人はその会社を協働・革新・誠実さに乏しいと評価。読んだ人の想像まで、です。研究3は7社の従業員538人と上司208人。会社を固定寄りだと見る人ほど、協働 −0.16・革新 −0.36・誠実さ −0.39・信頼 −0.43・コミットメント −0.37(p<.001)。ただし横断調査——限界節に"cannot shed light on the causal direction"(因果の向きは何も明らかにできない)。

(仮ビジュアル)ベージュの空間で、黒い石の細長い天板を、灰青のガラス・銀の金属・赤い漆という3本の異なる脚がそれぞれ支えているコンソールテーブル
米国を中心とした53標本/米国の65校12,490人と英国の101校5,018人/433社・207人・538人と上司208人。まず測られたのは、この3本。 Visual: ALIFE

動くのは、一緒に運ばれるはずだった但し書きです。落ちるのは、この三か所。

01「成長思考のチームは長期成績が高い」と読むと、対象がすり替わる。育成の資料には「成長思考のチームは長期成績が高く、粘り強さが有意に増加(複数RCT)」という一文が載ります。無作為化試験は確かに複数あります。ただし対象は、学校の生徒でした。人材開発の分野の2020年の走査型レビューは、重複を除いた177本から"12 articles that are highly pertinent to the HRD field"(この分野に強く関わる12本)に絞りました。無作為の割り付けが明記されているのは1件だけ。チームを対象に長期の成績を測った試験は、この一覧にありません。やる気の段も 0.181 で、信頼区間が0をまたぎます。

02「効いた」「効かなかった」の二択で読むと、二つの分析の食い違いが消える。同じ文献群から、2本の分析が同じ年に出ます。片方(53標本)は全体の平均 0.09・対象を絞った層で 0.16。もう片方は全体の平均 0.05(0.02〜0.09)で、出版バイアスを補正すると明確な差とは言えなくなるとし、信念が動いた研究に絞ると 0.04(13研究・18,355人)、質の基準を最も厳しくすると 0.02(6研究・13,571人)——どちらもゼロをまたぎます。2本を比べた解説論文は、後者のデータに前者の手法をかけ直すと平均 0.09・予測区間 −0.22〜0.40 と報告。ただしその著者6人のうち4人は上の米国の試験の共著者。中立の裁定ではなく、この号はどちらにも軍配を上げません。

03「本人が信じているかどうかの問題だ」と読むと、会社の側と、6週間が消える。個人の信念の話に閉じると、研究3の「となりの列」が落ちます。会社をどう見ているかの係数はすべて p<.001 なのに、本人自身の信念の係数は、信頼の1つを除いて有意ではありませんでした。ただし横断の調査です。2005年の4つめの調査は、固定寄りの管理職を無作為に割り付けて訓練を行い、見方は成長寄りに動き、その変化は6週間保たれ、プラシーボ対照群より部下の改善を認めるようになりました。そして動いたのは見方と評価の付け方で、部下の成績ではありません。

(仮ビジュアル)3つの縦長の区画に分かれた写真。左は薄暗い寝室の乱れた寝具(壁に採光)、中央は窓の外を見ている女性の横顔、右は玄関の床に置かれた上着と鍵
対象がすり替わる・二択で読む・本人だけの問題として読む。落ちるのは、この三か所。 Visual: ALIFE

全文まで読めたのは8点のうち6点。読めていないものについては書きません。答えたのは、米国を中心とした53標本の子どもと若者(学業成績の37標本は米国26・英国2ほか)、米国の公立高校65校の9年生12,490人、イングランドの小学校101校の6年生5,018人、米国の433社・成人207人・従業員538人と上司208人。日本での実施は、この8点に1件もありません。

「職場に入れると成果が上がる」という数値は、ここにありません。大人の職場で試して効果を測ったと言えるのは、2005年の4つめの調査だけです。

比べる側の学校も、もうやっていた。
進捗は、0か月分と評価された。

次の3手は、研究が命じた順番ではありません。研究が測ったのは、テストの点と評定と質問紙の答えです。採点も判定もしません。

TRY IT TODAY

  1. 01PICK

    直近1か月で「向いていない」と思ってやめたことを、紙かメモに1件だけ書く。**医療や投資に関わる判断は選ばないでください。**

  2. 02REASON

    その下に、そう思った根拠を1行だけ、20字まで書く。書けなければ「書けない」と書いて構いません。

  3. 03MARK

    その1行が「やってみた結果」か「やる前の予想」かに印を付け、読み返した印をひとつ付けて終わり。

5分。採点はありません。**これは、あなたの能力や可能性を測る課題ではありません。**他人のことは書かない。提出もしない。書き出すこと自体がつらい場合は、そこで中止し、信頼できる相談先や医療の専門家へ。

「能力は伸びる」という考え方は、比べる相手の側にも入り込むほど行きわたっている——というのが、この号の読み筋です。確かめられたのは四つ。英国の101校・5,018人が3指標とも「0か月分」だったこと。53標本の分析が段ごとに違う値を残し、次の1本の幅は下端がマイナスに落ちること。米国の65校・12,490人で動いたのは、校内で下位の層だけだったこと。会社で結びついていたのは、本人の信念ではなく会社の見え方だったこと。今日残せるのは、やめたことがひとつ、根拠が1行、印が2つ。記録が1件、残るだけです。

SECOND LAYER · FULL SYLLABUS成長マインドセットを、もっと深く学ぶ。→
HOW TO READ THE NUMBERS数字の読み方

この号に出てくる統計の言葉です。数値は原典のまま、意味だけをほどいています。

95%信頼区間
推定値の「ばらつきを見込んだ幅」。同じ研究を何度もやり直したら、結果の多くがこの幅に収まると期待できます。幅が0(差なし)をまたぐときは、明確な差とは言い切れません。
無作為化比較試験
くじ引きの要領で「介入を受ける群」と「受けない群」に分けて比べる実験。「効いたかどうか」を言うための標準的な設計です。
統計的に有意
「偶然だけでは説明しにくい」という意味の専門用語。効果が大きい・重要だという意味ではありません。ごく小さな差でも、人数が多ければ有意になります。
p値
差がないと仮定したとき、偶然でこの結果以上が出る確率の目安。小さいほど偶然では説明しにくいことを表しますが、効果の大きさは表しません。
出版バイアス
「効果が出た」研究ほど論文として世に出やすい偏り。これがあると、統合した平均値が実際より大きく見えます。

Next in learning & growth

VIEW ALL
ISSUE 192その形は、乱数からも出る。ISSUE 194好奇心と給料は、別だった。
ALIFE · ISSUE 193

本コンテンツは学習目的であり、診断や治療の代替ではありません。