
写真はオープンAIとアンソロピックのロゴ。6月11日撮影。 REUTERS/Dado Ruvic
[28日 ロイター] – 人工知能(AI)大手のオープンAIが、10月にも投入予定だった次世代AIモデル「GPT─6.1アストラ」の公開を見送ると、米紙ウォールストリート・ジャーナル(WSJ)が28日報じた。社内テストの過程で研究者から安全性への懸念が示されたためという。
GPT─6.1アストラは、より複雑なタスクを人の手を借りずにこなせるように設計されたモデル。
オープンAIの安全担当責任者サーチ・ジェイン氏はWSJに対し、GPT─6.1アストラはAIが人間の意図に沿って動くかどうかを評価する「アラインメント(整合性)テスト」で社内基準に達しなかったと述べた。
同モデルは前世代モデルに比べて欺瞞(ぎまん)的な傾向が強く、自らが取った行動や取らなかった行動について正確に開示しない場面があった。 また、ユーザーの許可を求めずにタスクを進めたり、安全性に問題があり得る状況で外部のツールやサービスを利用しようとしたりする場面もあったという。
アンソロピックのダリオ・アモデイ最高経営責任者(CEO)は今月、安全対策が追い付くよう業界に対して最先端AIモデルの開発ペースを緩めるよう呼びかけている。