GLOSSARY
テスト時コンピュート
答える段階でより多くの計算を使うこと — 長く考え、複数回サンプリングし、検証する — 事前にモデルを大きくすることだけでなく。
古典的なスケールの軸は学習時でした。より多くのパラメータ、より多くのデータ。テスト時コンピュートは新しい軸です。質問の時点で、モデルは段階的に熟考し(推論モデル)、多数の候補を生成して最良を選び(best-of-N)、自らの仕事に検証器を走らせます。o1/R1 クラスは、数秒の思考と正確さの取引が、はるかに大きなモデルを超えられると示しました。
これが製品経済を作り替えます。知能は質問ごとに借りられるものになり — 難問に多く、易問に少なく — 「思考レベル」ごとの課金や、その裏面のクエリごとのレイテンシ・コストの上昇に伴い、速いモデルと熟考モデルのルーティング(Groq/OpenRouter 生態がやるように)が設計スキルになります。