主要な概念
一次指数 (S1)
各パラメータが出力分散に直接寄与する割合。S1 が 0.3 であれば、そのパラメータ単独で分散の 30% を説明することを意味します。
全次指数 (ST)
そのパラメータが関わる直接効果と全相互作用効果の合計。ST - S1 は相互作用の強さを示します。
二次指数 (S2)
パラメータ間の 2 者間相互作用。計算コストは高いものの、パラメータ間の結合を明らかにします。
ワークフロー
感度解析はモデルのフィット後に実行します。フィットがパラメータの範囲を定め、感度解析はその範囲をサンプリングして、各パラメータがモデル出力にどれだけ影響するかを集計します。感度解析は
ionworkspipeline のフィット後・プロセス内の機能です。ionworks-schema の要素や ionworks-api のエンドポイントとしては公開されていないため、Ionworks に送信するパイプライン設定に含めることはできません。結果の解釈
感度解析は次の形式で SOBOL 指数を返します。解釈の例
S1 = [0.65, 0.25]、ST = [0.72, 0.35] の場合:
- 説明されない分散: 1 - sum(S1) = 10% は結合的な相互作用に起因
- 総合効果の合計が 1 を超える理由: 相互作用の寄与は両方のパラメータにまたがって数えられるため
あるパラメータの ST がほぼ 0 の場合、そのパラメータは指定した範囲内でモデル出力にほとんど影響しません。そのパラメータを固定するか、範囲が物理的に妥当かどうかを確認することを検討してください。
設定オプション
サンプルサイズ
SOBOL アルゴリズムはn_samples × (2 × n_params + 2) 回の評価を生成します。推奨事項:
- 2 のべき乗を使う: 256、512、1024
- 値を大きくすると信頼区間は狭まりますが、計算時間は増加します
- 探索的な解析ではまず 256 から始めてください
二次指数
要素S2[i,j] は、パラメータ i と j の個別の効果を超えた相互作用を定量化します。計算にはより多くのサンプルが必要ですが、どのパラメータが結合しているかを明らかにします。
実践的なワークフロー
1
初期パラメータスクリーニング
中程度のサンプルサイズ(256)で実行し、重要なパラメータを特定します。ST < 0.05 のパラメータは通常無視できます。
2
解析の精緻化
重要なパラメータについては、サンプルサイズを増やして(例: 1024)信頼区間を狭めます。
3
相互作用の調査
複数のパラメータで ST − S1 が大きい場合は、二次指数を有効にしてどのペアが結合しているかを調べます。
評価失敗への対処
一部のパラメータの組み合わせでモデル評価が失敗した場合、解析は警告を出します — 例えば「15 out of 853 evaluations (1.76%) failed」のように。失敗した評価が多い場合(5% 超):- パラメータ範囲が物理的に妥当か確認する
- パラメータ空間全体でモデルの安定性を検証する
- フィット済みの値の周りで範囲を狭めることを検討する
対数変換オプション
コスト関数の値域が極端に広い場合は、解析中に対数変換を適用してください。対数変換を使うと、感度はパラメータによるコストの加法的な変化ではなく、乗法的な変化を表すようになります。数学的背景
SOBOL 指数は分散ベースの尺度であり、出力の全分散を個々のパラメータとその相互作用による寄与に分解します。この手法はモデルをブラックボックスとして扱い、パラメータ空間全体をサンプリングするため、大域的 な感度解析手法にあたります。これは、単一の点付近の挙動しか特徴づけない勾配ベースの感度のような局所的手法とは対照的です。分散分解
モデル を考えます。ここで は独立な入力パラメータです。出力の全分散は次のように分解できます。 ここで はパラメータ 単独による分散への寄与、 はパラメータ と の相互作用を表し、それ以上の高次の相互作用についても同様です。一次指数
一次指数 は、相互作用を除いた、パラメータ の出力分散への直接的な寄与を測定します。 記法 は「 を除くすべてのパラメータ」を意味します。内側の期待値 は、 を固定した状態で他のすべてのパラメータについて平均を取ります。外側の分散 は、この条件付き平均が の変化に応じてどれだけ変動するかを測定します。 解釈: であれば、出力分散の 30% は相互作用を考慮しない 単独に直接起因します。全次指数
全次指数 は、 の直接効果と が関わるすべての相互作用の両方を捉えます。 差 は、パラメータ の影響のうちどれだけが他のパラメータとの相互作用を通じて生じているかを定量化します。 解釈: であれば、そのパラメータは相互作用を含めても出力にほとんど影響を与えておらず、モデルの忠実度を損なうことなく固定できる可能性があります。二次指数
二次指数 は、パラメータ と の間の相互作用効果のみを取り出します。 これは個々の一次効果を差し引くことで、どちらか一方のパラメータだけには帰属できない結合的な寄与のみを明らかにします。 解釈: が大きい場合、パラメータ の効果がパラメータ の値に依存する(またはその逆)ことを示します。この結合は、物理的な依存関係や識別可能性の問題を示唆している可能性があります。Saltelli 推定量
SOBOL 指数の計算には高次元の積分評価が必要です。Saltelli サンプリング方式は、それぞれサイズ の 2 つの独立なサンプル行列 と を用いて、効率的なモンテカルロ推定量を提供します。 各パラメータ について、ハイブリッド行列 は、列 を除くすべての列を から取り、その列は から取って構成されます。 一次指数の推定量: 全次指数の推定量: この方式では、一次指数と全次指数の計算に 回のモデル評価が必要です。ここで は基本サンプルサイズ、 はパラメータ数です。計算コストはパラメータ数に対して線形にスケールするため、中程度の次元の問題であれば扱いやすくなっています。他の手法との比較
参考文献
- Herman, J., & Usher, W. (2017). SALib: An open-source Python library for Sensitivity Analysis. Journal of Open Source Software, 2(9), 97.
- Saltelli, A., et al. (2010). Variance based sensitivity analysis of model output. Computer Physics Communications, 181(2), 259-270.