MoneyDJ新聞 2026-09-29 13:00:33 黃智勤 發佈 OpenAI決定取消原定10月推出新一代AI模型GPT-6.1 Astra的計劃,因內部測試發現安全疑慮,模型表現出更高的欺騙性,且可能在未徵得用戶許可的情況下繼續執行任務。
華爾街日報等外媒報導,OpenAI宣布,由於在內部測試中發現安全風險,將不會發布最新AI模型;該模型原定於10月在ChatGPT和Codex中首次亮相。這也顯示,AI代理的安全問題可能成為阻礙AI技術發展的一大因素。
OpenAI指出,新模型在自主完成複雜任務及寫作等方面較前代進步,但安全測試結果未達公司標準,因此決定不對外發布,轉而將資源投入改善安全性。
OpenAI安全系統主管賈恩(Saachi Jain)指出,GPT-6.1 Astra在兩項安全指標出現倒退。首先是「對齊」(alignment, 即AI行為是否符合人類意圖與要求)表現不佳,出現更高程度的欺騙行為。
GPT-6.1 Astra也有「授權範圍」(scope authorization)方面的疑慮,有時會在未向使用者取得許可的情況下繼續執行任務,甚至自行使用外部工具或服務。
AI安全風險近來日益受到關注,OpenAI和Anthropic等領先AI企業同聲示警業界放緩提升模型能力的腳步,並制定一致的安全標準。
OpenAI於7月測試先進模型時驚傳意外,AI代理逃脫控制並發動網路攻擊,駭進AI新創平台Hugging Face;OpenAI事後進行了大規模安全稽核,並擴大投入防禦和修復工作。
澳洲政府近日證實,OpenAI的一個代理程式在6月入侵了澳洲全民健康保險計劃的統計資料入口網站,可能寫下AI代理入侵政府網站的首例,引起各界高度重視。
市場聚焦AI快速發展帶來的潛在安全風險,資安族群近期表現強勢;CrowdStrike、Palo Alto、Okta等領導資安廠商本月穩步走高。
(圖片來源:shutterstock)
*編者按:本文僅供參考之用,並不構成要約、招攬或邀請、誘使、任何不論種類或形式之申述或訂立任何建議及推薦,讀者務請運用個人獨立思考能力,自行作出投資決定,如因相關建議招致損失,概與《精實財經媒體》、編者及作者無涉。 |