テクノロジー Claude Haiku 5.5とGPT-6 Lunaを同じ21回のテストで比べてみた──単価は同じで、合格は19対12。Claude Codeで回せば初の満点21/21。100万円のローカル機より、月3,000円のサブスクが現実的?(廉価モデル対決編)
OpenAIとAnthropicの廉価版、GPT-6 LunaとClaude Haiku 5.5を、同じVM・同じCodex CLI・同じ判定器の21回で比べました。単価は入力$0.10・出力$0.50でまったく同じ。合格は判定器どおりでHaiku 19/21、Luna 12/21(質も考慮して18/21)。速さは中央値58秒で同じ、費用はHaikuが2倍(21回で約40円と約20円)。Claude Codeで回すとxhighで21/21の初の満点で、Codexのxhighが伸びなかった正体は会話の上限でした。ローカルの最良モデル(Qwen3.8 Flash Next 17/21、27B 19〜20/21)とほぼ並び、50万〜120万円の機械より月3,000円のClaude Proが現実的、という話です。