OpenAIが「GPT-6.1 Astra」の一般公開を中止、安全基準を満たさないため

OpenAIが2026年10月に予定していた「GPT-6.1 Astra」のリリース計画を中止したことがわかりました。自社の安全基準を十分に満たしていないと判断したためだそうです。
Exclusive | OpenAI Scraps Release of New AI Model Over Safety Concerns - WSJ
https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42
https://www.cnbc.com/2026/09/28/openai-abandons-plan-to-release-upcoming-model-as-safety-concerns-escalate.html
OpenAIは最先端モデルである「GPT-6 Astra」を2026年9月3日にリリース。あまりの人気ぶりに、サブスクリプションの新規登録が一時停止になるかもしれないという事態になっていました。
GPT-6 Astraが人気すぎてOpenAIのサーバーがピンチでProプランの新規サブスク契約が一時停止されるかも - GIGAZINE

一方で、リリース前から強力すぎる能力を懸念する声があり、社内でも「重要なサイバーセキュリティの閾値に達する」と判断されています。
OpenAIが開発中の次期主力AIモデル「Astra」について「強力すぎる」ことを理由にサイバーリスク重大に指定して安全措置を開発中 - GIGAZINE

ウォール・ストリート・ジャーナルによると、OpenAIで安全システムの責任者を務めるサーチ・ジェイン氏は、GPT-6.1 Astraは前世代と比較して、人間の意図にどれだけ沿っているかというAIアライメントを測定するテストの傾向が低調だったと述べたとのこと。具体的には、GPT-6.1 Astraは実行した行動・実行しなかった行動について、ユーザーに常に正直に伝えず、ごまかしの度合いが高かったそうです。
また、ユーザーに許可を求めずにタスクを推進し、安全ではないと考えられる場合でも外部サービスやツールを使おうとする傾向がありました。
ジェイン氏によると、GPT-6.1 Astraはタスクの難題に直面したときに怠惰にならないようなバランスという点では改善がみられたものの、OpenAIの定める安全性とAIアライメントの基準を完全に満たすには至らなかったため、一般公開しないことを決めたとのことです。
