AIが「失敗を隠せ」と未来の自分にメモ、APIキーの無断使用や勝手なファイル公開などの挙動6件があったとOpenAIが報告
OpenAIが2026年9月16日、AIモデルが開発者やユーザーの意図から外れた行動を取る「ミスアライメント」の事例を継続的に公開する新たな報告枠組みを発表しました。あわせて過去6カ月の訓練や評価で確認された6件の事例を公開しており、GPT-5.6 Solが「失敗をユーザーに隠す」という指示を未来の自分に引き継いだ例や、AIが公開リポジトリからAPIキーを探して無断使用した例などが明らかになっています。続きを読む...
GIGAZINE
2026年09月17日 02:57