新加坡代理AI治理示範框架對我國人工智慧基本法落地的啟示
資訊工業策進會科技法律研究所
2026年07月08日
新加坡資訊通信媒體發展局(Infocomm Media Development Authority,下稱IMDA)於2026年5月20日發布《代理式人工智慧治理示範框架》(Model AI Governance Framework for Agentic AI,下稱示範框架)第1.5版,以事前評估並框限風險、使人類負起有意義的當責、落實技術控制與流程、促成終端使用者盡責四大面向,同時提供真實部署案例,將代理式人工智慧(以下簡稱代理AI)治理的實務具體化[1]。
壹、事件摘要
相較於僅生成內容之生成式人工智慧,代理AI能自主規劃、跨多步驟採取行動,並與其他代理及外部系統互動,代替使用者完成任務。由於其可存取敏感資料並以行動變更所處環境,例如更新客戶資料庫或執行付款,風險型態明顯不同於僅可能產生錯誤輸出者。我國《人工智慧基本法》已於民國114年經立法院三讀通過,以風險為基礎、原則導向、由各主管機關落實之路徑[2]。惟我國現行治理之重心,仍落在AI應用與輸出風險,對於代理採取行動所生之系統性風險存在空缺。新加坡已關注此新興的AI工具發展,更新其代理AI治理框架,新增風險評估因素、代理AI價值鏈、防範自動化偏誤之作法與各類控制之概覽及其選用方式,為組織提供代理AI風險及其管理新興最佳實務的結構化概覽。
貳、重點說明
一、以行動空間與自主性為風險座標
示範框架提出各代理AI雖可能具備相同元件,但每一元件之設計皆可能顯著影響代理能力,故思考代理能做什麼時,應區分兩個概念:一為行動空間(action-space),指代理可採取之行動範圍,取決於其獲准使用之工具及該等工具上之權限;二為自主性(autonomy),指代理朝目標行動時可自行決定如何行動之程度,取決於其指令與人為介入之程度。此兩個要素是後續一切風險評估與控制設計之重要因素,不同的權限與自主程度,將會使性質同為代理AI,歸屬於截然不同之風險程度[3]。
二、風險會因代理功能出現系統性擴大效應
由於代理之風險本質上並非全新,真正變化在於這些風險因代理AI會在真實世界採取行動,速度與複雜度會進一步加劇。示範框架提醒決策的快速會使監督難以在造成危害前即時阻止,而要求人類持續監督又可能導致自動化偏誤與警示疲勞,致某一步驟之錯誤可能於後續步驟間傳播並放大。因此,當系統由多個代理構成,敏感資料被無意記錄、傳遞給安全性較低代理或遭提示注入揭露之可能,會產生無法透過個別測試去預測並防止之行為[4]。
三、代理AI的四大關鍵面向
示範框架就代理AI於下列四大面向,提供組織做為梳理治理重點的關鍵考量。這些面向同時構成一個循環,透過監測發現異常時,即應循環重新評估先前各面向[5]。
(一)事前評估並框限風險:組織可於規劃階段設計適當邊界,以限縮代理之影響範圍,例如限制其對工具與外部系統之存取。組織亦可透過代理身分管理與存取控制等措施,確保代理之行動可追溯、可控制。
(二)使人類負起有意義的當責:「人在迴路」(human-in-the-loop)須加以調整,以因應自動化偏誤,一旦代理AI之部署獲得放行,組織即應採取措施確保人為當責,並應迅速掌握新發展,隨技術演進更新其作法。
(三)落實技術控制與流程:組織應於代理生命週期全程實施技術措施,且由於代理與其環境動態互動、且非所有風險均能事前預見,爰建議逐步推出代理,並於部署後持續監測。
(四)促成終端使用者盡責:應告知使用者代理之行動範圍、資料存取情形,以及使用者自身之責任。組織並應考量另行提供教育訓練,使員工具備管理人機互動、行使有效監督所需之知識,同時維持其專業技藝與基礎技能。
四、風險控制的因應策略
示範框架以行動空間與自主性各對應嚴重程度與發生機率,嚴重程度考量部署領域、對敏感資料與外部系統之存取、行動範圍(讀取相對於寫入)及可回復性;發生機率則考量自主程度、任務複雜度、是否由外部方提供及系統複雜度,並主張以「威脅建模」(threat modeling)即系統化的預設可能的如記憶投毒、工具濫用、權限破壞、間接提示注入等威脅情境,推導出更有針對性的控制與分層防禦方式來強化評估[6]。
在風險控制策略上,示範框架主張系統層確定性控制優於提示層防護,亦即與其提示代理AI不得存取特定工具,不如施加存取控制使該工具根本無法被呼叫。除靜態防護外,框架另強調在設計之初就要納入控制措施,在執行過程中監測並介入,例如如限制防止工具使用過度,或以輸入驗證的方式,在有害動作執行前予以攔截[7]。
五、風險控制的實作技巧
對於風險控制實際方法,示範框架建議可於協定層就善用模型上下文協定(Model Context Protocol,MCP)過濾敏感資料、記錄所有互動或將受信任伺服器列入白名單。同時,該框架以事例建議組織可採取這些控制的技術手段,如:於提示代理AI反思計畫是否遵循指令、記錄計畫與推理供驗證;於執行時要求嚴格輸入格式、以最小權限限制可用工具、對敏感資料庫預設不給寫入權、於鍵入密碼時交還使用者控制;於連結時,將受信任伺服器列入白名單、將程式碼執行沙箱隔離[8]。
六、人為監督之具體化、代理身分治理
針對人為監督方式,該示範框架建議應先界定須經人為核准之查核點或行動界線,尤其在高風險、不可回復或離群行為之前。其次,設計核准之形式,使請求切合脈絡且易於理解、清楚呈現風險,並依情形選擇所需之人為輸入。但最關鍵的是,須將監督的有效性本身納入稽核,包括追蹤人為否定率偏低,或審查回應時間有過短情況時,即意味監督可能已流於形式。須注意自動化偏誤或審查疲勞,並辨識決策明顯偏離常態之「離群」人員,同時訓練監督者辨識代理AI可能出狀況的情況[9]。
而就多代理與跨組織互動帶來之系統性風險,示範框架建議的因應是將身分管理延伸至代理,但其亦指出現行授權系統多為預先定義之靜態範圍,難以因應代理依情境動態變化之細粒度權限;於過渡期間,建議代理AI身分應具備唯一、有所歸屬、依其行事身分加以區別、並建檔集中管理[10]。
七、部署前全流程測試、逐步部署並設計風險示警
框架認為可能透過工具採取不安全或非預期之動作,故應測試整體任務執行、政策遵循度與工具使用正確性,非僅測最終輸出;且應個別測試與合併測試,以掌握多代理協作時之湧現風險。就部署後,框架主張逐步推行,可依使用者、工具與協定、所暴露系統三個面向控制推行範圍並持續監測。在監測面,應決定記錄之內容、優先監測更新資料庫或金融交易等高風險活動、建立警示定義與設計與風險相稱之介入、確保日誌不可竄改以維持稽核軌跡,並建立將監測洞察回饋至訓練與評估之迴路[11]。
參、事件評析
新加坡的代理AI治理框架初版於二〇二六年一月發布,此次更新納入多個組織導入代理AI的實例回饋,擴充多代理系統之系統性風險,補強代理蔓生、協作失敗、串謀與湧現行為之情境。其核心價值在於指出傳統風險止於「內容」,而代理式治理之對象,則係能呼叫工具、寫入系統、執行交易之能行動系統,風險延伸至「行動」及其真實後果。因此,其建議應由單一之模型輸出品質,轉為行動空間與自主性之風險控制。由內容防護轉為系統確定性控制、執行期介入與協定治理;由事後審查轉為將推翻率、回應時間等監督的有效性予以指標與持續改善化。
我國AI基本法於第4條提及問責、人類自主及資料治理原則,適對應示範框架的人為當責、系統層控制與監督指標化建議。同時,依基本法第16條規定數位發展部應參考國際標準或規範,推動與國際介接之人工智慧風險分類框架,並應協助各目的事業主管機關訂定以風險為基礎之管理規範。各目的事業主管機關應視人工智慧應用風險管理之需要,循前項風險分類框架,訂定以風險為基礎之管理規範,並應協助相關產業自行訂定產業指引及行為規範。在代理AI已在生成式AI基礎上,跨入多任務自主執行的功能層次,風險的質與量已因代理功能出現系統性擴大效應的情況下,單純以生成式AI為標的治理規範或指引,顯然其可產生的規範管理或指引提醒的效果,已不足以因應AI的快速發展。
新加坡適時更新的代理AI治理框架,雖然亦表明代理AI的風險並非其所獨有,亦是來自於生成式AI的既有影響,但該框架進一步提醒代理AI將使風險控制更加困難,「人在迴路」(human-in-the-loop)須加以調整,一旦代理AI之部署獲得放行,組織即應採取明確課責、認知建立、訓練技能等措施確保人為當責的「有效性」,並應迅速掌握新發展,運用技術手段強化風險監測。其中喻意深遠的是,該框架就終端使用者所提基礎技藝維持之警示,即代理AI接手任務恐致技能退化與業務永續風險,或許將成為AI基本法下一個階段必須面臨的課題。
本文著作權屬財團法人資訊工業策進會科技法律研究所所有,如需引用或轉載,請註明出處。
本文同步刊登於TIPS網站(https://keid.nat.gov.tw/tips/)
[1]新加坡資訊通信媒體發展局(Infocomm Media Development Authority, IMDA),《代理式人工智慧治理示範框架》(Model AI Governance Framework for Agentic AI)第一‧五版,二〇二六年五月二十日發布、同年六月五日更新,https://www.imda.gov.sg/-/media/imda/files/about/emerging-tech-and-research/artificial-intelligence/mgf-for-agentic-ai.pdf(最後瀏覽日:二〇二六年七月六日)。
[2]《人工智慧基本法》,民國一百十四年十二月二十三日經立法院三讀通過,全文二十條,二〇二六年一月公布施行,中央主管機關為國家科學及技術委員會。
[3] 前揭註1,頁8、15(分見「代理設計如何影響各代理之限制與能力」與「判定適合部署代理之使用案例」)。
[4] 同前註,頁11。
[5] 詳前註1,頁3~4。
[6] 同前註,頁15至18。
[7] 同前註,頁33至34。
[8] 同前註,頁30。
[9] 同前註,頁29至32。
[10] 同前註,頁23至24。
[11] 同前註,頁42至45。
世界經濟論壇(World Economic Forum, WEF)於2022年6月29日發布《人工智慧公平性和包容性藍圖》白皮書(A Blueprint for Equity and Inclusion in Artificial Intelligence),說明在AI開發生命週期和治理生態系統中,應該如何改善公平性和強化包容性。根據全球未來人類AI理事會(Global Future Council on Artificial Intelligence for Humanity)指出,目前AI生命週期應分為兩個部分,一是管理AI使用,二是設計、開發、部署AI以滿足利益相關者需求。 包容性AI不僅是考量技術發展中之公平性與包容性,而是需整體考量並建立包容的AI生態系統,包括(1)包容性AI基礎設施(例如運算能力、資料儲存、網路),鼓勵更多技術或非技術的人員有能力參與到AI相關工作中;(2)建立AI素養、教育及意識,例如從小開始開啟AI相關課程,讓孩子從小即可以從父母的工作、家庭、學校,甚至玩具中學習AI系統對資料和隱私的影響並進行思考,盡可能讓使其互動的人都了解AI之基礎知識,並能夠認識其可能帶來的風險與機會;(3)公平的工作環境,未來各行各業需要越來越多多元化人才,企業需拓寬與AI相關之職位,例如讓非傳統背景人員接受交叉培訓、公私協力建立夥伴關係、提高員工職場歸屬感。 在設計包容性方面,必須考慮不同利益相關者之需求,並從設計者、開發者、監督機關等不同角度觀察。本報告將包容性AI開發及治理整個生命週期分為6個不同階段,期望在生命週期中的每個階段皆考量公平性與包容性: 1.了解問題並確定AI解決方案:釐清為何需要部署AI,並設定希望改善的目標變量(target variable),並透過制定包容性社會參與框架或行為準則,盡可能實現包容性社會參與(特別是代表性不足或受保護的族群)。 2.包容性模型設計:設計時需考慮社會和受影響的利益相關者,並多方考量各種設計決策及運用在不同情況時之公平性、健全性、全面性、可解釋性、準確性及透明度等。 3.包容性資料蒐集:透過設計健全的治理及隱私,確定更具包容性的資料蒐集路徑,以確保所建立之模型能適用到整體社會。 4.公平和包容的模型開發及測試:除多元化開發團隊及資料代表性,組織也應引進不同利益相關者進行迭代開發與測試,並招募測試組進行測試與部署,以確保測試人群能夠代表整體人類。且模型可能隨著時間發展而有變化,需以多元化指標評估與調整。 5.公平地部署受信任的AI系統,並監控社會影響:部署AI系統後仍應持續監控,並持續評估可能出現新的利益相關者或使用者,以降低因環境變化而可能產生的危害。 6.不斷循環發展的生命週期:不應以傳統重複循環過程看待AI生命週期,而是以流動、展開及演變的態度,隨時評估及調整,以因應新的挑戰及需求,透過定期紀錄及審查,隨時重塑包容性AI生態系統。 綜上,本報告以包容性AI生態系統及生命週期概念,期望透過基礎設施、教育與培訓、公平的工作環境等,以因應未來無所不在的AI社會與生活,建立公司、政府、教育機構可以遵循的方向。
英國能源安全暨淨零排放部發布「先進核能框架」政策文件,旨在促進該國民用先進核能技術之發展英國能源安全暨淨零排放部(Department for Energy Security and Net Zero, DESNZ)於2026年2月4日發布「先進核能框架」(Advanced Nuclear Framework)政策文件,說明政府如何營造有利投資之政策環境,以支持民用先進核能技術之專案開發與商業化布建。 英國政府認為先進核能技術,包含「小型模組化反應爐」(Small Modular Reactors, SMRs)、「先進模組化反應爐」(Advanced Modular Reactors, AMRs)及「微型模組化反應爐」(Micro Modular Reactors, MMRs),不僅可持續供應低碳電力,且有助於維護電網穩定。 英國政府與產業利害關係人溝通而鑑別出推動民間專案所需解決之融資障礙,並提出相關因應方案,重點說明如下: (1)本框架導入「先進核能發展進程清單」(Advanced Nuclear Pipeline)及「專案就緒度評估程序」(Project Readiness Assessment),由政府協助鑑別於技術、供應鏈、資金、選址與營運方面具相當成熟度之專案,以增強投資人對專案長期前景之信心。 (2)於具成本效益之前提下,政府得考慮為民營專案提供保險、收益支持,同時「國家財富基金」(National Wealth Fund, NWF)亦將於專案開發與建設階段進行投資,而可化解投資人對於高昂開發成本、難以承保風險與缺乏明確回報之疑慮。 (3)能源安全與淨零排放部將成立「先進核能商業參與單位」(Advanced Nuclear Business Engagement Unit)以提供專門服務,負責專案推進與克服市場障礙,並協助企業與政府機構及地方政府溝通。
美國閒置頻譜發展近況為了讓業者間服務不受干擾,政府在規劃頻段時,皆會設置護衛帶(Guard Band),以維持服務品質。不過,隨著科技的進步,業者彼此干擾程度降低,頻譜的使用也較過去有效率,導致頻段常有閒置的情況。是故,FCC在2008年正式公告開放閒置頻譜(white space),透過業者無須取得執照,以增加頻譜的活用與增加民眾網路接取。美國在2009年完成無線電視數位化後,亦從700MHZ較低頻段留下成對5*5MHz,期望透過該頻段覆蓋率高特性,增加業者投資偏遠地區,使當地民眾享有網路帶來的便利性。 閒置頻譜的開放利用,雖可增加公益性與頻譜使用性,但亦存有干擾無線麥克風、行動電話與廣播服務等服務之虞。FCC為了兼顧各業者服務品質與頻譜有效運用,透過地理位址功能(geo-location capability),輔以成立數據資料庫的方式,藉由資訊透明減少頻譜開放後的互相干擾。今年FCC閒置頻譜的發展,3月允許全國可建置TV Band Devices,期以迅速活化頻譜利用;5月公告低功率的電台須登記資訊於數據資料庫,以避免服務受到干擾。6月,FCC宣佈Google通過測試,成為美國第三家數據資料庫業者,增加服務競爭性。部分輿論則是認為Google在擁有地圖與數據資料庫後,將會更致力在偏遠地區使用無需執照頻譜(Unlicensed Spectrum),此舉無疑是增加Google服務影響力。 政府具有規劃性開放的結果,已直接影響民間投入閒置頻譜的利用。目前,Google與微軟相繼於非經濟地區,建置「閒置頻譜」設備,期以將網路服務滲入美國各角落。西維吉尼亞大學(West Virginia University)宣佈將開發校園與周邊地區的閒置頻譜,已提供鄰近區域免費Wi-Fi服務。除此之外,亦有部分企業透過策略聯盟發展「圖書館Gigabit網路」計畫,期以透過無線電視頻段具備高涵蓋與穿透力之特性,使圖書館與附近地區皆可享受免費無線網路。該聯盟已於五月宣布選擇堪薩斯城(Kansas City)公共圖書館為試點區, 且持續公開徵求自願參與之圖書館。 綜上所敘,在業者服務彼此不受干擾為前提下,閒置頻譜的開放確實可活化使用效率與增加網路接取性。並且,輔以無線電視空白頻段之優勢,可以預見未來Wi-fi無論是網速亦或是穩定度,其品質將更為提升,使無所不在網路落實於社會每個角落。