採点競技の点数はどう決まるのか——合計点トップが優勝しない仕組みを調べました
採点競技の大会では、審査員ごとの点数まで載った結果表が公開されます。うちの子の大会でその表を眺めていて、私は不思議なことに気づきました。素点——審査員が付けた点そのもの——の合計がいちばん高い選手が、優勝していないクラスがあるのです。それも、同じ大会の複数のクラスで。
集計ミスではありませんでした。実施要項を読むと、「順位と合計点の逆転は起こり得る」と最初から明記されていたのです。つまりあの逆転は、仕組みが設計どおりに動いた結果でした。
白状すると、私は採点競技の点数がずっと腑に落ちていませんでした。レベルの差が大きい組なら、順位に納得がいく。でも上級者同士になると、どこで差がついたのか、見ていてもわかりません。「主観的な項目が多いから、審査員によって点はバラバラなのだろう」とも思っていました。だから、紙と論文を読みました。
先に結論を書きます。採点競技の点数は、審査員の主観をなくす方向にはできていません。主観が入ることを前提に、一人の偏りでは結果が動かないように組まれています。 そして論文は、その仕組みでも消えない偏りと、仕組みの作り方しだいで偏りの出方が変わることまで教えてくれました。答えの半分は配点表と実施要項という紙に、もう半分は論文にありました。
国際フィギュアスケート競技会の採点データで、くじで決まるはずの演技順が点数と結びついていることを示した研究(2006年発表。国際大会の採点記録を後から分析した研究のため、参加者を集めた国はありません)
Bruine de Bruin W. Save the last dance II: unwanted serial position effects in figure skating judgments. Acta Psychologica. 2006;123(3):299-311.[2]
紙の側——順位は「上下を捨ててから」決まっていた
まず紙の側です。うちの子の競技の配点表では、100点の内訳は技術35・表現35・振付や構成20・作品の魅力10でした。技術と表現が同じ重さ。そして表現から後ろを合わせた65点は、「どう見えたか」を審査員が判断する項目です。「主観的な項目が多い」という私の実感は、配点表の事実としては正しかったことになります。
意外だったのは、順位の決め方でした。素点の合計ではありません。審査員ごとに付けた順位をいったん点数に置き換え、選手ごとに、いちばん高い評価といちばん低い評価を捨ててから合計する方式です。
なぜそんな手間をかけるのか。架空の数字で見てみます。5人の審査員がある選手に90点・88点・87点・85点・60点を付けたとします。平均は82点。60点を付けたたった一人が、全体を5点近く引き下げています。平均という計算は、1つの外れた数字に引っ張られるのです[6][7]。では、いちばん高い90点といちばん低い60点を捨ててから平均すると——約87点。しかもこの87点は、60点が仮に0点だったとしても動きません。順位への置き換えには、もうひとつの働きがあります。点の大小を捨てて「何番目に置いたか」だけを使うので、ある審査員が誰かに飛び抜けて高い点を付けても、順位の上では「1番に置いた」以上のことはできません。一人の極端な点を効かなくする装置が、二重に入っているのです。
素点合計トップが優勝しない逆転は、この装置の故障ではなく、動いた跡です。要項があらかじめ逆転を予告していたのは、そういう意味でした。
くじで決めた順番でも、公平にはならなかった
紙の側がここまで守っているのに、論文の側は、それでも消えない偏りを報告しています。代表が、演技の順番です。
国際的なフィギュアスケート競技会では、1回目の演技順はくじ——実力と関係なく——で決まります。ところが採点データを調べると、1回目に後で滑った選手ほど、1回目だけでなく2回目の点まで高くなっていました[2]。くじなのに、です。先行研究では、歌のコンテストでも同じ「後ろほど高い」が出ていて、しかも全員の演技が終わってからまとめて採点しても、1人ずつその場で採点しても、効果は変わりませんでした[1]。「審査員が最初の方を忘れるから」だけでは説明がつきません。
もうひとつ気になる記述があります。この競技会の方式では、1回目の成績が良い選手ほど、2回目は後に滑ります[2]。後ろが有利なら、この方式は強い選手をさらに有利にする向きに働くことになります。
「後に出た方が有利」——私も事実だと思っていました。半分は当たっていました。でも、半分です。男子体操の種目別決勝を12大会ぶん調べた研究では、演技順と最終順位やメダルのあいだに、はっきりした関連は見つかりませんでした[3](例外はあん馬だけでした)。競技によって違う。「採点競技はどれもそうだ」とは言えません。
審査員の点は、思ったよりそろっていた
次は、バラつきの方です。「主観の項目が65点もあるなら、点は審査員によってバラバラだろう」。そう予想して読んだ研究で、予想は外れました。
格の違う2つの国際大会(女子体操)の採点を比べた研究では、審査員たちの点は非常によくそろっていました[4]。完全に一致すると1になる指標がどちらの大会でも0.94を超え、審査員ごとの平均点のずれはほぼゼロ。この指標は、1に近いほど審査員どうしの点が一致していることを表す目盛りです。大会の格が違っても採点の質は同等だった、というのが著者らの結論です。しかも同じ体操の研究では、一人の審査員の点のそろい方より、審査員団の平均のそろい方の方が高いことが報告されています。上下カットの前に、そもそも複数人で採点して平均すること自体が、一人の癖を薄める装置なのです。
ここで終われば、めでたい話でした。でも同じ研究は、逆向きのことも検出しています。種目によっては、審査員団の全員が、そろって同じ方向に傾いている兆候が出ました[4]。全員が同じようにずれても、そろい方の指標は高いままです。点がそろっていることは、点が正しいことの証明にはなりません。
同じ人の偏りが、選び方で逆向きに出る
最後に、いちばん考えさせられた研究です。そもそも中立な審査員は、どこから連れてくればいいのでしょうか。演技を採点できるだけの専門性を持つのは、現役や引退した選手、コーチ——競技の内側の人だけです。外側の人は中立かもしれませんが、採点ができません。中立を「人」に求めることは、はじめから難しいのです。
2002年の冬季オリンピックの採点データを分析した研究があります[5]。スキージャンプとフィギュアスケートのどちらでも、審査員が自国の選手に高めの点を付ける偏りが確認されました。人の側は、どちらの競技も同じだったわけです。ところが、偏りの現れ方は逆でした。分かれ目は審査員を誰が選ぶか。スキージャンプでは国際連盟が審査員を選びます。偏った採点をした審査員は次に選ばれにくく、他の審査員の偏りを打ち消す方向に採点する傾向さえ見られました。一方、当時のフィギュアスケートでは各国の連盟が審査員を選んでいました。この形では、自国に有利な審査員ほど選ばれやすくなります。同じ人の偏りが、選び方という仕組みの違いで、抑えられもすれば強められもする——上下カットにも審査員団の平均にも通っていた考え方が、審査員の選び方にまで通っていました。
この記事で言えないこと
ここで挙げた研究が調べたのは、フィギュアスケートや体操などのトップレベルの国際大会です。子どもの大会や、ほかの採点競技に同じ結果がそのまま当てはまるかはわかりません。演技順の効果は競技で割れており、審査員のそろい方も種目によって差があります[4]。そして、審査員団ごと傾く偏りが子どもの大会の順位をどれだけ動かすのかを測った研究は、見つけられませんでした。
家庭でできること
紙と論文を読んで、わが家の結果表の読み方は3つ変わりました。
- 配点表を、子どもと一度読んでみる。 うちの競技では技術と表現が同じ重さでした。順位や合計点よりも、この重み——何がどれだけ評価されるのか——の方が、次の練習につながる情報を持っています。「技術は届いていたから、差がついたとすれば表現の側かもね」と、配点表のことばで振り返れるようになります
- 一人の審査員の点を、順位の理由にしない。 上下カットと順位への置き換えは、一人の極端な点が結果を動かさないための装置です。「あの審査員が辛かったから」という説明は、仕組みの上ではほぼ成立しません。そしてこの説明を使わずにおくことは、子どもが結果を人のせいにしない練習にもなります
- 順位と合計点が逆転した結果表に出会ったら、仕組みの話をする。 「壊れているんじゃなくて、一人の点に引っ張られないための仕組みが働いた跡だよ」。この一言のために、この記事を書いたようなものです
私はいまも、上級者同士の演技のどこで差がついたのかは、見てもわかりません。それでも、結果表を前にして子どもに話せることは、確かに増えました。
- Bruine de Bruin W. Save the last dance for me: unwanted serial position effects in jury evaluations. Acta Psychologica. 2005;118(3):245-260. PubMed
- Bruine de Bruin W. Save the last dance II: unwanted serial position effects in figure skating judgments. Acta Psychologica. 2006;123(3):299-311. PubMed
- Chen CY, Chen KH, Lu KH. Start order and medal outcomes: an analysis of apparatus finals in men's artistic gymnastics. PLoS One. 2026;21(6):e0351760. DOI
- Bučar Pajek M, Čuk I, Pajek J, Kovač M, Leskošek B. Is the quality of judging in women artistic gymnastics equivalent at major competitions of different levels? Journal of Human Kinetics. 2013;37:173-181. PubMed
- Zitzewitz E. Nationalism in winter sports judging and its lessons for organizational decision making. Journal of Economics & Management Strategy. 2006;15(1):67-99. DOI
- Huber PJ, Ronchetti EM. Robust Statistics. 2nd ed. Hoboken: Wiley; 2009.
- Wilcox RR. Introduction to Robust Estimation and Hypothesis Testing. 4th ed. London: Academic Press; 2017.
本記事は論文と公開資料に基づく一般的な情報提供であり、特定の大会・団体・審査員について述べるものではありません。個別の採点・判定については、各競技団体の公式資料をご確認ください。