作品の仕組み 2026-09-29

脳スペックIQ診断の仕組み ― 問題を毎回生成し、正解するほど難しくして、誤差ごと返す

脳スペックIQ診断(IQ登山)は、問題を人が用意せず、ページを開くたびにプログラムが乱数から組み立てるIQテストです。図形行列・数列・回転・記憶・言語類推の5種類を、正解すると難しく、外すと易しくなる適応式で10〜14問。能力の推定には項目反応理論の簡易版を使い、推定IQと誤差(±)を必ず一緒に返します。結果を「脳のスペック表」にした理由、既知のバグの見つけ方、サーバーで採点を再現する仕組み、そして何を測っていないかを書きます。

目次を見る →

この記事の位置: [AIが作り、コードが検分する] → 送らない(端末の中で完結する) → 数字と実寸 → 教材の設計

IQ登山の最初の問題は、いつも「レベル4」から始まります。3×3の図形の行列で、動く属性は二つ。正解すれば次はレベル5、外せばレベル3。10問目を過ぎたところで、推定の誤差が一定より小さくなれば終わり、大きければ14問目まで続く。この「登り下り」の仕組みが、脳スペックIQ診断の骨組みです。

一つ目の決まりは、問題を毎回その場で作ることです。図形行列なら、形・数・塗り・回転のどれを動かすかを乱数で選び、選択肢のダミーも乱数で組む。数列なら、等差・倍・階差・交互・フィボナッチ型などの規則から一つを選び、初項と差を乱数で決める。回転判定は、盤の模様を乱数で塗り、正解は回転したもの、ダミーは鏡像。記憶は数字やカタカナの列を乱数で作る。言語類推だけは、自分で書いた問題のプールから抽選します。同じ問題は二度と出ず、答えを検索することもできません。既存のIQテストの問題は一切使っていないので、著作権の問題もありません。

二つ目は、難しさの階段です。各種類の問題に、レベル1から10の難しさを定義しています。図形行列は動く属性の数(1→4)と選択肢の数(4→6)、数列は規則の複雑さ、回転は盤の大きさ(3→5)とセルの数、記憶は列の長さ(4→8)と逆順・カタカナ、言語類推は語の難しさ。同じ「レベル6」なら、種類が違っても正解率がだいたい同じになるように調整しています。

三つ目が、適応式の出題と推定です。答えるたびに、能力の推定値(θ)を計算し直します。計算には項目反応理論の3パラメータ・ロジスティックモデルの簡易版を使い、「その難しさの問題を正解できる確率」から、θの事後平均を求めます。当てずっぽうで当たる確率(4択なら25%)も織り込みます。次の問題のレベルは、θから決めます。だから、正解が続く人は急な坂を登り、外す人はなだらかな道に戻る。誤差(推定の標準誤差)が0.42を下回り、かつ10問以上答えていれば終了、それまでは最大14問まで続けます。

ある一回の登山 ― 答えるたびに能力の推定値(θ)が動き、誤差が縮む
ある一回の登山 ― 答えるたびに能力の推定値(θ)が動き、誤差が縮む-0.60.61.81問3問5問7問9問11問12問推定値 θ推定値 θθ+誤差θ+誤差θ−誤差θ−誤差θ

推定値 θ:1問 0.4θ、3問 0.9θ、5問 0.6θ、7問 1.1θ、9問 1.3θ、11問 1.2θ、12問 1.25θ/θ+誤差:1問 1.4θ、3問 1.6θ、5問 1.2θ、7問 1.6θ、9問 1.75θ、11問 1.6θ、12問 1.65θ/θ−誤差:1問 -0.6θ、3問 0.2θ、5問 0θ、7問 0.6θ、9問 0.85θ、11問 0.8θ、12問 0.85θ

推定IQ=100+15×θ。この例は12問目で誤差が0.42を下回り終了(推定IQ 119、±6)。正解すると上に、外すと下に動き、問題数が増えるほど点線の幅が狭くなる。

推定IQは、θを平均100・標準偏差15の尺度に換算し、60〜160の範囲で表示します。誤差(±)は標準誤差の15倍で、最低でも±4。14問程度のテストで測れるのは、せいぜい±7〜10の幅までです。その幅を隠して一つの数字だけを出すのは嘘になるので、誤差はいつも一緒に返します。「理論上の上位◯%」は正規分布から計算した理論値で、実際の利用者の順位ではありません。

四つ目は、結果の形です。数字を一つ返すのではなく、パソコンのスペック表にしました。推定IQと誤差、CPU(処理速度:正解した問題の目安秒数と実際の秒数の比の中央値をGHz表記に)、RAM(作業記憶)・GPU(空間認識)・論理ユニット・パターン認識・言語ユニットの各得点(種類ごとの推定と全体の推定を混ぜたもの)、型番(KL-推定IQ-最強パーツの文字-ランク)。

5種類の問題と、難しさの上げ方
種類スペック表の名前難しくなると
図形行列パターン認識動く属性が1→4に、選択肢が4→6に
数列論理ユニット等差→倍→階差→交互→フィボナッチ型・素数差
回転判定GPU(空間認識)盤が3×3→5×5に、ダミーは鏡像
記憶再生RAM(作業記憶)列が4→8に、逆順、カタカナ
言語類推言語ユニット自作プール30問からレベル近傍を抽選

「既知のバグ」は、反応時間と正誤の組み合わせから見つけます。速く答えて外した問題が多い種類には「焦ると◯◯が落ちる(早押しミス◯件)」、じっくり考えて当てた問題が多ければ「起動は遅いが、落ちない」。逆順の記憶で崩れた人には「逆順RAMクラッシュ」。悪口ではなく、取扱説明書の体裁にしています。最後に外した問題も表示しますが、答えは教えません。次は別の問題が出るからです。

五つ目は、採点の場所です。回答(選んだ番号と所要時間)と、問題を作った乱数の種をサーバーに送り、サーバー側で問題を作り直して採点します。ブラウザ側の計算を信じないのは、結果の改ざんを防ぐためと、共有URLで同じ結果を再現するためです。生成AIは採点にも出題にも使っていません。同じ答え方をすれば、同じ結果になります。

共有は、結果ごとの固有のURLと、山の絵に旗が立ったカード画像です。海抜0メートルから4,200メートルまでを高度帯に分け、それぞれに「賢いと言われる動物」を置きました(諸説あり)。頂上のタコ、カラス、イルカ、イヌ、ゾウ、麓のナマケモノ。ネコは測定を拒否して山小屋で寝ています。動物に優劣はなく、どこまで登れたかを、笑って人に見せられる形にするためのものです。

測っていないことも書いておきます。これは医学的・心理学的な知能検査ではありません。正式な検査は専門家が一時間以上かけて行うもので、こちらは四分のエンタメです。就職や教育の判断に使えるものではなく、結果があなたの知能を断定するものでもありません。名前もメールアドレスも入力せず、サーバーに残るのは乱数の種と回答の列だけです。

なぜ十問から十四問なのか。問題を増やせば誤差は小さくなります。二十問なら誤差は±五程度まで縮む計算ですが、途中で離脱する人が増えます。四分で終わる長さと、誤差を±七前後に収める精度の間で、十から十四に置きました。誤差が早く縮む人(正解と不正解がはっきり分かれる人)は十問で終わり、揺れる人は十四問まで続く、という形で、時間と精度の折り合いをつけています。

難しさのレベルは、最初は理論値で決めています。「レベル六の図形行列は、レベル六の数列と同じくらいの正解率になるはず」という設計上の見立てです。利用者の回答が溜まれば、実際の正解率でレベルを並べ直すことができ、そのときに「上位◯%」も理論値から実測に切り替える予定です。それまでは、画面に「理論値」と明記しています。見立てを実測のように見せないことが、この作品の決まりの一つです。

反応時間の扱いも書きます。種類とレベルごとに「目安の秒数」を決めておき、正解した問題について、目安と実際の秒数の比を取ります。その中央値がCPUの値です。平均ではなく中央値にしたのは、一問だけ考え込んだ、途中で電話が鳴った、といった外れ値に引きずられないためです。既知のバグの「早押しミス」は、目安の半分より速く答えて外した問題を数えています。速さそのものを責める仕組みではなく、速さと正誤の組み合わせを見ています。

Track 06の雨がやまないまま終わるKOTODAMAと同じで、この診断も「できることだけを正直にやる」作品です。問題を毎回作る、誤差を隠さない、答えを教えない。三つの決まりで、四分の登山を作りました。

執筆:長澤 湊(宅地建物取引士・行政書士・測量士補) 内容確認日:2026-09-29

この記事は制度と手続きの一般的な説明で、個別の事案についての法律・税務の相談や判断ではありません。制度や数字は内容確認日の時点のものです。ご自身の事案は、弁護士・司法書士・税理士・行政書士など、該当する専門家に確かめてください。

あわせてどうぞ

解説記事一覧