Claude Code のセッションで「なんかおかしい」と感じたときに、体感を他人と共有可能な数字に落とすための手順書です。同じ context を別 model に resume して比較すれば、n=1 の個体差反論を潰した形で GitHub Issue や社内共有に使える定量データが取れます。実測では着地時間で 27 倍差、thinking-only tokens で 32 倍差が出ました。
Claude Code は各セッションを `~/.claude/projects/<cwd>/<session-uuid>.jsonl` に構造化ログとして残しています。この jsonl を読めば、assistant の 1 ターンごとに thinking / text / tool_use のどれが返ったかが分かります。同じ session を claude --resume <uuid> --model <id> で継承すれば、context を固定したまま model だけ変えて比較できます。thinking-only ターン数・auto-inject 回数・thinking-only tokens・着地までの秒を機械集計すれば、体感の色々が桁の差の数字になります。