米国の自主的AIモデルテスト計画はガバナンスの節目ですが、オープンウェイトシステムを除外するという報告された決定は構造的な盲点を生み出しています。能力はますますオープンまたはセミオープンなリリースを通じて提供され、ツールやエージェントで微調整、量子化、組み合わせが可能です。標準化されたテストレーンがなければ、これらのモデルは断片的またはアドホックな評価のまま製品や研究に広がり、安全性やポリシー要件を文脈やバージョンを超えて満たしているかどうかを判断しなければならない購入者、CISO、コンプライアンス担当者に不確実性をもたらします。
自主的プログラムはしばしば調達の規範、リスク開示、保険会社の質問票の基盤となります。オープンウェイトモデルがその基盤の外にある場合、導入者が証明責任を負います。つまり、誤用リスク、生物・化学・害悪の促進、欺瞞的使用、モデル仕様の遵守、児童安全フィルター、セキュリティ体制を重みのバリアントや微調整にわたってカバーする証拠を構築する必要があります。また、モデルの出所管理も複雑になります。重みがダウンロードされると、管理の連鎖やパッチ管理はベンダーの保証だけでなく企業の責任となり、監査準備を維持するために新たな運用管理が必要となります。
実際の効果としては、二速のガバナンス市場が生まれます。クローズドプロバイダーは公式テスト参加を示せますが、オープンウェイトのプロバイダーや統合者は独自の証明書、レッドチームの成果物、ベンチマークの再現性を提供しなければなりません。企業はサプライヤーのSBOM、署名済み重みマニフェスト、管理された微調整パイプライン、特定のチェックポイントに紐づくインシデント対応プレイブックを義務付けることで受け入れ体制を強化します。法務チームは微調整後の禁止能力に関する保証を求め、セキュリティチームはモデル変更が可能な場合の隔離や出口ポリシーを要求します。調達は精度や遅延だけでなく保証成熟度で差別化されるようになります。
戦略的には、このギャップはオープンウェイト保証の革新を加速させる可能性があります:標準化されたモデル証明書、コミュニティ運営の評価スイート、安全信号の相互運用性など。しかし、米国の購入者、EU/英国の規制当局、業界団体が異なる期待を採用することでコンプライアンスが分断される恐れもあります。賢明な構築者は調達を通じた収束を予測すべきです。大規模購入者は公開テストを反映した調和された証拠パックを要求できます。勝者は検証可能な管理を伴うオープンウェイトの柔軟性をパッケージ化し、バージョン管理されたチェックポイント、署名済みアダプター、透明な安全対策、規制産業に関連する実際の誤用シナリオに沿った継続的評価を提供します。


