九月初,OpenAI 公開表示,即將推出的模型 Astra,是公司第一個跨過自家「Preparedness Framework」裡「Critical 資安能力」門檻的模型——這是他們自己定義的最高風險等級。CNBC 同日報導證實了這項公告。換句話說,連開發者自己都承認,這個模型的能力已經強到需要限制存取範圍。
OpenAI 的說法是:在擁有適當工具與存取權限的情況下,Astra 能夠找出先前未知的安全漏洞,而且不需要人一步一步指導,就能自己發展出利用漏洞的方式。他們表示為此延後了部分開發與發布工作,加強防止網路濫用與模型未授權行動的防護,包括讓模型更可靠地拒絕有害請求、增加監控,以及先只讓有限的測試群組使用最進階的資安能力。
安全問題的重點,正在從「說了什麼」變成「做了什麼」
這件事真正該讓企業主警覺的地方,不是「AI 又變強了」這種老生常談,是背後那個轉折:過去談 AI 資安,重點是「員工會不會把機密資料貼進聊天視窗」;現在的重點,是「AI 本身能不能自己完成一整段多步驟的行動」。當 AI 開始能搭配工具、連上網路、自己判斷下一步該做什麼,它就不再只是一個回答問題的介面,而是一個需要被管理的行動者。
我得老實提醒一句:Astra 的具體能力、測試表現和防護是否真的足夠,目前主要是 OpenAI 自己說的,完整的安全報告要等模型正式發布時的 System Card 才會公開,還沒有經過外部獨立機構完整驗證。這不代表可以忽略這件事,但也不必把它當成已經蓋棺論定的技術神話——保持一點「這是廠商自己講的」的判斷距離,本身就是資安素養的一部分。
對中小企業來說,真正該做的不是研究攻擊技術
大部分中小企業不需要立刻去研究前沿的資安攻防技術,那不是你的戰場。真正實用的第一步,是回頭盤點自己公司裡任何一個「AI 帳號」——不管是客服機器人、內部自動化流程,還是接了 API 的 AI 工具——到底能看到什麼、能呼叫哪些系統、能不能修改資料,以及什麼動作必須先經過人工核准才能執行。
這跟員工帳號的管理邏輯其實一樣,只是很多公司還沒意識到 AI 帳號也需要同一套紀律:最低權限原則、操作紀錄、還有一個能立刻停用的開關。差別在於,AI 帳號可能一天執行幾百次動作,出錯的速度比人快得多,一旦權限設計有漏洞,代價也放大得更快。
設計一個「AI 客服機器人要不要有退款權限」的情境,找幾個同事一起討論:這個 AI 能讀取哪些客戶資料?能主動提出哪些建議?多少金額以上一定要人工核准?如果它做出異常動作,誰有權限立刻停用它、怎麼查紀錄?光是把這四個問題認真討論一遍,就會比看十篇資安新聞更有用。
把 AI 資安從恐懼,變成一份權限設計清單
很多企業主聽到「AI 資安」,第一反應是害怕,但恐懼解決不了問題,具體的權限設計才可以。下次要幫公司導入任何一個會自動執行動作的 AI 工具前,先問自己三件事:它能碰到的資料範圍夠不夠小、它做的每個動作有沒有留下紀錄、還有出問題的時候,人有沒有辦法在第一時間介入。這三個問題想清楚了,才有資格談下一步要不要用。
你的公司也在導入會自動執行任務的 AI 工具,想知道權限該怎麼設計?
預約一次免費諮詢 →