IN ARTS · ISSUE 077
● 12 SEC自分の動きを撮った映像を見せると、言葉だけの指導より学習が進むのか。2021年の系統的レビューが、体育の場面でこれを調べています。2,030件を検索し、基準を満たしたのは11件。全体としては、映像のほうが有効に見えました。ただし内訳です。採用された11件のうち10件では、学習者は映像に加えて、主な誤りと見るべき要点についての教師の言語的フィードバックを受け取っていました。
この号が扱うのは、客観的になる方法ではありません。自分についての評価が、どこまで測られてきたかのほうです。自分の演奏を、自分は客席から聴けない。この不便のまわりに、医師の自己評価から音楽コンクールの審査まで測定が積まれています。芸事をしていない人も、読者から外れません。
自己観察精度(Self-Observation Accuracy)は、自分の演技や作業についての自己評価が、外から観察された評価とどれだけ揃うかを指します。芸道でこれが難しいのは、覚悟や正直さの前に観測点の問題だからです——踊り手は、鏡を見た瞬間に視線が正面から外れます。というのが、この号の読み筋です。観測点の違いが誤差をどれだけ生むかを比べた研究は、この号にはありません。

では、その揃わなさはどれだけ測られてきたのか。「下手なほど自分を高く見る」という図の読み方は、いま論争のただ中です。まず測られたのは、この3つです。
01記録の揃った職種でも、20件中13件。2006年の系統的レビューは、725本から17研究を採用し、医師の自己評価と外部から観察された能力の比較を20件抽出しました。うち13件で、関係はほとんどないか逆向き。不正確さが目立ったのは技能のもっとも低い医師と自信のもっとも高い医師、との報告も。医学教育の場面をまとめたもので、測り方も研究ごとに違います。示されたのは関連の乏しさで、自己評価が能力を下げると示したものではありません。
02実験室では、13.2と52.8が並んだ。1999年の研究は、ユーモア・論理・文法の課題で、自分の成績と他人と比べた順位を推定させました。成績の低い群ほど順位を高く見積もっています。2008年の論文がこの系列を整理し直すと、論理課題の成績下位四分位は、実際には13.2パーセンタイルにいながら、自分の成績を52.8、一般的な能力を54.9パーセンタイルと見積もっていました——パーセンタイルは100人に並べたときの位置で、50が真ん中。対象は大学生、実験室の短いテストです。
03929人では、予測されたばらつきが出なかった。2020年の研究は、地域社会の929人に、知能の自己評価と客観的な課題を行わせました。仮説どおりなら能力の低い側で自己評価のばらつきが大きくなる——不等分散——はずが、検出されませんでした。検出されなかったことは、偏りが無いと証明したことではありません。関係はほぼ完全に直線で、効果の大きさはこれまでの報告よりずっと小さい可能性があるが著者らの結論。2016年の研究は1,154人分の対データから、問題のある作図の慣行が解釈上の人為物を持ち込みうると論じました(たどれたのは抄録まで)。

ここで止めると、「だから自分を疑って、とにかく録画しよう」に着地します。検算します。手がかりは3つ。
01録画を、それだけで情報だと思っている。録画そのものが情報を運ぶ、とは言えていません。冒頭の11件中10件では、映像に教師の言語的フィードバックが付いていました。運動の経験が少ない年少の学習者は映像から得るものが少なく、初期段階では言語のフィードバックのほうが妥当だと著者らは述べます。体育の場面の11件であり、大人の学び直しを測ったものではありません。
02音と映像を、混ぜたまま見ている。2013年の研究は、国際音楽コンクール決勝進出者の記録で、7つの実験・のべ1,164人に優勝者を当てさせました。三択で、偶然の水準は33%。素人の正答率は映像だけで46.4〜52.5%、音だけで25.5〜28.8%。プロでも映像だけで46.6〜47.0%、音だけで20.5〜25.7%。両方与えると素人35.4%・プロ29.5%と偶然の水準に戻ります。2018年の追試は結果を二つに割りました。同じ映像の実験1(N = 375)では映像のみ38.7%で再現。材料を変えた実験2(N = 300)と、演奏の質の差を明確にした実験3(N = 150)で消え、実験3では音声条件の68.4%が映像のみの45.2%を上回りました。著者らは、原研究の解釈可能性は限定的だと結論。再現されなかったのではなく、材料しだいで出たり出なかったりした、という結果です。どちらも、審査という一場面の実験です。
03揃わなさを、性格の問題として読んでいる。2006年のレビューが並べたのは、記録も試験も評価制度も揃った職種での20比較のうち13件でした。揃わなさを、その人の甘さの指標として読むには足りません。加えて1999年の研究のうち訓練を課した実験では、短い訓練のあと、下位群の見積もりのずれは訓練前より小さくなっています。精度は固定した性質ではなく、動く量として測られてきました。ただしこれは、大学生に短い訓練を課した実験室課題です。

六つは矛盾しません。医師でも実験室でも自己評価は外からの評価と揃わず、同時に929人の検証では、仮説が予測するばらつきの偏りが検出されませんでした。2008年の論文自身も、回帰効果や平均以上効果といった代替の説明では下位群の大きな過大評価は説明しきれなかったと報告しています。論争は決着していません。古典の側と批判の側を、同じ確からしさで置きます。
全文まで読めたのは8点のうち5点。残る3点は公式抄録の範囲までで、そこから先は書きません。研究の場面は医学教育・大学生・体育の授業・音楽コンクールとばらばらで、参加者は欧米に偏り、多くが一回きりの課題です。向きはともかく、大きさをそのまま自分の稽古場へ持ち込めるものではありません。動かないのは、順位ではなく誤差の幅のほうです。
測られたのは、揃わなさの幅まで。
順位のほうは、稽古場では読めない——というのが、この号の読み筋。
だから次の3手も、研究が命じた順番ではありません。観点を先に決めれば自己評価が正確になる、と確かめた研究を、この号では扱っていません。ここからはALIFEが提案する実践の入口です。一行残れば足ります。
TRY IT TODAY
- 01WRITE
見る観点を1つだけ、紙かメモに書く。右手首の高さ、語尾の伸ばし方、包丁を置く位置など。
- 02RECORD
今日の稽古や練習から、90秒だけを録画または録音する。全部は録らない。
- 03SPLIT
まず音だけで1回、次に映像だけで1回通す。最後に、書いた観点についてだけ一行書く。
自己観察精度は、客観性につけられた別名ではありません。確かめられたのは、医師の20比較のうち13件で関係が乏しいか逆向きだったこと、実験室の下位四分位が13.2パーセンタイルにいながら自分の成績を52.8と見積もったこと、929人ではばらつきの偏りが検出されず、関係はほぼ直線だったこと、映像フィードバックの11件のうち10件に教師の言葉が付いていたこと。正確になるとも、上手くなるとも、研究は約束していません。——今日残るのは評価ではありません。観点が1つと、見終わってからの一行。それだけです。
SECOND LAYER · FULL SYLLABUS自己観察精度を、もっと深く学ぶ。→HOW TO READ THE NUMBERS数字の読み方+
この号に出てくる統計の言葉です。数値は原典のまま、意味だけをほどいています。
- 系統的レビュー
- あらかじめ決めた基準で研究をもれなく集めて整理する方法。数値の統合(メタ分析)まで行わないこともあります。

