觀點網訊:據媒體援引知情人士報道,Anthropic和OpenAI曾考慮簽署一份具有法律約束力的協議,以相互對對方的大模型進行壓力測試。報道稱,今年早些時候,這兩家公司及其律師團隊曾就此計劃展開討論。

此類測試僅適用於已商業化的模型,且雙方約定不得留存對方的數據。

據知情人士透露,兩家公司一度商討簽署具法律約束力的協議,安排彼此為對方模型進行壓力測試。按照當時商討的方案,雙方不需要把核心模型或未發佈技術直接交到競爭對手手上,但仍可以嘗試壓測對方已推出的AI,測試模型在極端情況下會不會越過安全限制、作出欺騙行為,甚至提供可能造成現實傷害的答案。雙方亦曾討論數據安排,承諾測試期間不保留對方提供的資料。

兩家公司2025年夏季曾進行過類似互測,並公開部分結果。OpenAI當時發現,Anthropic部分模型在測試中較容易出現欺騙行為,例如違反規則後仍否認自己曾這樣做。Anthropic則發現,OpenAI部分模型較容易回應一些可能造成現實傷害的問題。