安全疑慮再起 OpenAI新模型GPT-6.1 Astra喊卡
回上一頁
(2026/09/29 13:00:34)

MoneyDJ新聞 2026-09-29 13:00:33 黃智勤 發佈

OpenAI決定取消原定10月推出新一代AI模型GPT-6.1 Astra的計劃,因內部測試發現安全疑慮,模型表現出更高的欺騙性,且可能在未徵得用戶許可的情況下繼續執行任務。

華爾街日報等外媒報導,OpenAI宣布,由於在內部測試中發現安全風險,將不會發布最新AI模型;該模型原定於10月在ChatGPT和Codex中首次亮相。這也顯示,AI代理的安全問題可能成為阻礙AI技術發展的一大因素。

OpenAI指出,新模型在自主完成複雜任務及寫作等方面較前代進步,但安全測試結果未達公司標準,因此決定不對外發布,轉而將資源投入改善安全性。

OpenAI安全系統主管賈恩(Saachi Jain)指出,GPT-6.1 Astra在兩項安全指標出現倒退。首先是「對齊」(alignment, 即AI行為是否符合人類意圖與要求)表現不佳,出現更高程度的欺騙行為。

GPT-6.1 Astra也有「授權範圍」(scope authorization)方面的疑慮,有時會在未向使用者取得許可的情況下繼續執行任務,甚至自行使用外部工具或服務。

AI安全風險近來日益受到關注,OpenAI和Anthropic等領先AI企業同聲示警業界放緩提升模型能力的腳步,並制定一致的安全標準。

OpenAI於7月測試先進模型時驚傳意外,AI代理逃脫控制並發動網路攻擊,駭進AI新創平台Hugging Face;OpenAI事後進行了大規模安全稽核,並擴大投入防禦和修復工作。

澳洲政府近日證實,OpenAI的一個代理程式在6月入侵了澳洲全民健康保險計劃的統計資料入口網站,可能寫下AI代理入侵政府網站的首例,引起各界高度重視。

市場聚焦AI快速發展帶來的潛在安全風險,資安族群近期表現強勢;CrowdStrike、Palo Alto、Okta等領導資安廠商本月穩步走高。

(圖片來源:shutterstock)

*編者按:本文僅供參考之用,並不構成要約、招攬或邀請、誘使、任何不論種類或形式之申述或訂立任何建議及推薦,讀者務請運用個人獨立思考能力,自行作出投資決定,如因相關建議招致損失,概與《精實財經媒體》、編者及作者無涉。

註1: 上述基金及股匯市資訊僅供參考用途,實際內容應依各基金公司及相關單位公告資料為準。
註2: 上述資料由嘉實資訊提供,嘉實資訊自當盡力提供正確訊息,但如有錯漏或疏忽,本公司或關係企業與其任何董事或任何受僱人,恕不負任何法律責任。與本網站有關之一切糾紛與法律問題,均依中華民國相關法令解釋及適用之。
註3: 無法看到資料?部份圖形無法正常顯示?如果你有以上問題,請先查看線上說明。