英國發布《AI保證介紹》指引,藉由落實AI保證以降低AI系統使用風險
資訊工業策進會科技法律研究所
2024年03月11日
人工智慧(AI)被稱作是第四次工業革命的核心,對於人們的生活形式和產業發展影響甚鉅。各國近年將AI列為重點發展的項目,陸續推動相關發展政策與規範,如歐盟《人工智慧法》(Artificial Intelligence Act, AI Act)、美國拜登總統簽署的第14110號行政命令「安全可靠且值得信賴的人工智慧開發暨使用」(Executive Order on the Safe, Secure, and Trustworthy Development and Use of Artificial Intelligence)、英國「支持創新的人工智慧監管政策白皮書」(A Pro-innovation Approach to AI Regulation)(下稱AI政策白皮書)等,各國期望發展新興技術的同時,亦能確保AI使用的安全性與公平性。
壹、事件摘要
英國科學、創新與技術部(Department for Science, Innovation and Technology,DSIT)於2024年2月12日發布《AI保證介紹》(Introduction to AI assurance)指引(下稱AI保證指引),AI保證係用於評測AI系統風險與可信度的措施,於該指引說明實施AI保證之範圍、原則與步驟,目的係為讓主管機關藉由落實AI保證,以降低AI系統使用之風險,並期望提高公眾對AI的信任。
AI保證指引係基於英國政府2023年3月發布之AI政策白皮書提出的五項跨部會AI原則所制定,五項原則分別為:安全、資安與穩健性(Safety, Security and Robustness)、適當的透明性與可解釋性(Appropriate Transparency and Explainability)、公平性(Fairness)、問責與治理(Accountability and Governance)以及可挑戰性 與補救措施(Contestability and Redress)。
貳、重點說明
AI保證指引內容包含:AI保證之適用範圍、AI保證的三大原則、執行AI保證的六項措施、評測標準以及建構AI保證的五個步驟,以下將重點介紹上開所列之規範內容:
一、AI保證之適用範圍:
(一)、訓練資料(Training data):係指研發階段用於訓練AI的資料。
(二)、AI模型(AI models):係指模型會透過輸入的資料來學習某些指令與功能,以幫助建構模模型分析、解釋、預測或制定決策的能力,例如GPT-4。,如GPT-4。
(三)、AI系統(AI systems):係利用AI模型幫助、解決問題的產品、工具、應用程式或設備的系統,可包含單一模型或多個模型於一個系統中。例如ChatGPT為一個AI系統,其使用的AI模型為GPT-4。
(四)、廣泛的AI使用(Broader operational context):係指AI系統於更為廣泛的領域或主管機關中部署、使用的情形。
二、AI保證的三大原則:鑒於AI系統的複雜性,須建立AI保證措施的原則與方法,以使其有效執行。
(一)、衡量(Measure):收集AI系統運行的相關統計資料,包含AI系統於不同環境中的性能、功能及潛在風險影響的資訊;以及存取與AI系統設計、管理的相關文件,以確保AI保證的有效執行。
(二)、評測(Evaluate):根據監管指引或國際標準,評測AI系統的風險與影響,找出AI系統的問題與漏洞。
(三)、溝通(Communicate):建立溝通機制,以確保主管機關間之交流,包含調查報告、AI系統的相關資料,以及與公眾的意見徵集,並將上開資訊作為主管機關監理決策之參考依據。
三、AI保證的六項措施:主管機關可依循以下措施評測、衡量AI系統的性能與安全性,以及其是否符合法律規範。
(一)、風險評估(Risk assessment):評測AI系統於研發與部署時的風險,包含偏見、資料保護和隱私風險、使用AI技術的風險,以及是否影響主管機關聲譽等問題。
(二)、演算法-影響評估(Algorithmic-impact assessment):用於預測AI系統、產品對於環境、人權、資料保護或其他結果更廣泛的影響。
(三)、偏差審計(Bias audit):用於評估演算法系統的輸入和輸出,以評估輸入的資料、決策系統、指令或產出結果是否具有不公平偏差。
(四)、合規性審計(Compliance audit):用於審查政策、法律及相關規定之遵循情形。
(五)、合規性評估(Conformity assessment):用於評估AI系統或產品上市前的性能、安全性與風險。
(六)、型式驗證(Formal verification):係指使用數學方法驗證AI系統是否滿足技術標準。
四、評測標準:以國際標準為基礎,建立、制定AI保證的共識與評測標準,評測標準應包含以下事項:
(一)、基本原則與術語(Foundational and terminological):提供共享的詞彙、術語、描述與定義,以建立各界對AI之共識。
(二)、介面與架構(Interface and architecture):定義系統之通用協調標準、格式,如互通性、基礎架構、資料管理之標準等。
(三)、衡量與測試方式(Measurement and test methods):提供評測AI系統的方法與標準,如資安標準、安全性。
(四)、流程、管理與治理(Process, management, and governance):制定明確之流程、規章與管理辦法等。
(五)、產品及性能要求(Product and performance requirements):設定具體的技術標準,確保AI產品與服務係符合規範,並透過設立安全與性能標準,以達到保護消費者與使用者之目標。
五、建構AI保證的步驟(Steps to build AI assurance)
(一)、考量現有的法律規範(Consider existing regulations):英國目前雖尚未針對AI制定的法律,但於AI研發、部署時仍會涉及相關法律,如英國《2018年資料保護法》(Data Protection Act 2018)等,故執行AI保證時應遵循、考量現有之法律規範。
(二)、提升主管機關的知識技能(Upskill within your organisation):主管機關應積極了解AI系統的相關知識,並預測該機關未來業務的需求。
(三)、檢視內部風險管理問題(Review internal governance and risk management):須適時的檢視主管機關內部的管理制度,機關於執行AI保證應以內部管理制度為基礎。
(四)、尋求新的監管指引(Look out for new regulatory guidance):未來主管機關將制定具體的行業指引,並規範各領域實踐AI的原則與監管措施。
(五)、考量並參與AI標準化(Consider involvement in AI standardisation):私人企業或主管機關應一同參與AI標準化的制定與協議,尤其中小企業,可與國際標準機構合作,並參訪AI標準中心(AI Standards Hubs),以取得、實施AI標準化的相關資訊與支援。
參、事件評析
AI保證指引係基於英國於2023年發布AI政策白皮書的五項跨部會原則所制定,冀望於主管機關落實AI保證,以降低AI系統使用之風險。AI保證係透過蒐集AI系統運行的相關資料,並根據國際標準與監管指引所制定之標準,以評測AI系統的安全性與其使用之相關影響風險。
隨著AI的快速進步及應用範疇持續擴大,於各領域皆日益重要,未來各國的不同領域之主管機關亦會持續制定、推出負責領域之AI相關政策框架與指引,引導各領域AI的開發、使用與佈署者能安全的使用AI。此外,應持續關注國際間推出的政策、指引或指引等,研析國際組織與各國的標準規範,借鏡國際間之推動作法,逐步建立我國的AI相關制度與規範,帶動我國智慧科技產業的穩定發展外,同時孕育AI新興產應用的發展並打造可信賴、安全的AI使用環境。
本文為「經濟部產業技術司科技專案成果」
挪威交通部(Ministry of Transportation)甫於本月推出電子通訊法(Electronic Communication Act)修法草案,其主要針對1-5、2-12、4-14條之規定進行修正,期望透過確認主管機關對費率和爭端處理程序等事項之管轄權和財務補貼,解決歐盟(European Union;EU)和歐洲經濟區(European Economic Area;EEA)內,長期爭議不決的國際漫遊費率問題。 強調區域整合的泛歐盟經濟體(含27個EU會員國和挪威、列支敦士登、冰島3個EEA會員國),雖在貨物、人口、服務、貨幣之自由流通等,各項單一市場上的努力上相當成功,但其電信漫遊之跨國界服務,卻經常受到各界批評,主要問題即源自於居高不下的跨國漫遊費率。因歐洲地理和人口分佈稠密度甚高,居民極容易使用跨國電信服務,但卻需負擔動輒數倍的國際漫遊費用問題。近年來歐盟有意對此尋求解決之道,而挪威此次修法即為初步重要嘗試之一。
新加坡推動全球首部生成式AI測試國際標準—ISO/IEC 42119-8提案新加坡推動全球首部生成式AI測試國際標準—ISO/IEC 42119-8提案 資訊工業策進會科技法律研究所 2026年08月04日 生成式AI快速普及,惟其輸出之品質、安全與可信賴程度如何檢驗,各國迄今尚無公認之測試標準。新加坡資訊通信媒體發展局(Infocomm Media Development Authority, IMDA)與新加坡企業發展局(Enterprise Singapore, EnterpriseSG)於2026年4月第17屆ISO/IEC JTC 1/SC 42人工智慧分技術委員會全體會議[1]中,公開《人工智慧—AI測試—第8部分:運用生成式AI之提示型文字對文字系統品質評估》(ISO/IEC AWI TS 42119-8)提案,並將其定位為全球首部就生成式AI系統測試方法而設之國際標準[2]。 壹、事件摘要 新加坡提出之ISO/IEC 42119-8,係運用其AI Verify與全球AI保證沙盒(Global AI Assurance Sandbox)累積之測試成果,以基準測試(benchmarking)與紅隊測試(red teaming)做為兩大檢測手段,所擬訂之生成式AI提示型文字對文字系統品質評估方法。該標準與同系列第7部分(ISO/IEC 42119-7)及ISO/IEC 23282相互銜接,於2025年9月已在ISO登錄,現處經核准工作項目(Approved Work Item)之準備階段,尚未定發布日期[3]。會議期間,新加坡並與美國國家標準協會、ISO國際組織及AI Verify基金會合作舉辦工作坊與交流會議,促其標準推進於國際間凝聚共識[4]。 貳、重點說明 一、ISO/IEC 42119系列以「AI測試」為主軸,第8部分處理生成式AI之品質評估 ISO/IEC 42119係ISO/IEC JTC 1/SC 42就AI系統之測試與保證新近規劃之AI測試共通方法系列標準[5]。該系列第8部分聚焦運用生成式AI之提示型文字對文字系統,涵蓋以紅隊測試進行之安全性檢測,並就評估結果之分析與記錄提供指引,並與同系列第7部分(紅隊測試,ISO/IEC 42119-7)及ISO/IEC 23282(自然語言處理系統評估方法)相互銜接。依主辦之IMDA與EnterpriseSG所述,該標準以提升測試結果之可重複性與可比較性為目標,藉基準測試與紅隊測試,使不同組織評估AI輸出品質時,結果更具一致性與可比較性,從而強化各界對AI系統之保證與信任[6]。 二、AI Verify以11項治理原則為基準,併行流程檢核與技術檢測 AI Verify係新加坡IMDA主導、由AI Verify基金會於2023年推動之開源測試框架,用以填補AI治理原則與可供稽核證據之間之落差。其以透明、可解釋、可重複、安全、資安、穩健、公平、資料治理、當責、人為監督,以及包容性成長(Inclusive Growth)、社會與環境福祉 (Societal and Environmental Well-being)11項治理原則為基準[7]。 AI Verify之檢驗分為流程檢核(Process Checks)與技術檢測(Technical Testing)。流程檢核依「原則、預期成效、流程、證據」(Principle, Outcome, Process, Evidence)四層展開檢核事項[8],要求擬測機構以文件證據佐證其治理流程確有落實,所需文件例如治理政策、模型與資料處理紀錄、內部審查程序等。各檢核項目中,於可解釋、安全、穩健、公平四項原則之部分檢視項目,並列有進行技術檢測的項目[9]。 三、以Project Moonshot工具對應生成式AI AI Verify基金會的AI Verify框架原係以傳統AI為對象,為因應大型語言模型的檢測,其推出Project Moonshot做為前述技術檢測於生成式AI的主要測試工具。Moonshot提供逾100組基準資料集供進行基準測試,以分級評分評估模型在多種能力上的表現,例如語言與語境理解。Project Moonshot 亦提供自動化紅隊攻擊模組,可同時測試多個大型語言模型應用程式,節省時間與資源也確保模型效能的全面評估。Project Moonshot 的網頁介面並提供優化的測試流程,因應不同應用程式的多元需求,引導使用者只辨識並執行最相關的測試,使用者也可以利用自訂資料集調整測試,以評估模型是否符合其獨特使用情境[10]。 四、全球AI保證試點與沙盒媒合測試,以實測經驗作為標準前導 新加坡以全球AI保證機制(Global AI Assurance)串接前述工具與國際標準,由IMDA與AI Verify基金會共同主導,先後推出「試點(Global AI Assurance Pilot)」與「沙盒(Global AI Assurance Sandbox)」兩個措施。前者媒合生成式AI應用之開發者與專業測試業者(如Resaro、LatticeFlow AI、Advai等),就幻覺、不當內容、對抗弱點等風險進行技術測試。試點自2025年2月啟動,至同年5月彙整成果,已媒合17家應用部署者與16家測試業者[11]。後者則將試點之媒合做法予以常態化與擴大,使其自階段性試辦轉為長期運作之機制[12]。此機制屬軟性之自願測試,新加坡政府並不直接強制監管,而係以實作指引與測試媒合降低採用障礙、蒐集資料作為技術測試標準之前導、扶植AI保證服務市場[13]。 依IMDA的全球AI保證沙盒報告說明,其全球AI保證試點(Global AI Assurance Pilot)的AI測試焦點已從「基礎模型安全」移到「實際應用之端到端可靠性」,鑑於將基礎模型與現有資料來源、流程及系統整合的複雜度較高,生成式AI風險評估很大程度上取決於使用情境。該報告並歸納提出四個生成式AI評測的實務建議:測試優先序應依應用之風險輪廓調整,風險愈高者測試愈嚴;適格之測試資料集須由人與AI共同產製,兼顧代表性與品質;除最終輸出外,尚應檢視模型運作之中間流程節點;可運用大型語言模型協助評測,但須有人工校準,以免評分失真[14]。 五、AI測試業者認可計畫(AI TAP):從沙盒媒合走向測試供給端之制度化 前述試點與沙盒雖已媒合開發者與測試業者,惟受媒合之測試業者其資格良窳,仍多賴個案判斷。AI Verify Foundation爰於2026年5月19日發布「AI測試業者認可計畫」(AI Tester Accreditation Programme, AI TAP),規劃就測試業者本身設計認可基準,並建立合格測試業者名單,使企業採用外部測試服務時得有所依循[15]。 認可方式採取五個評估面向,包括測試AI風險之技術能力、營運信譽(含實績)、財務永續性、營運量能,以及所宣稱業務範圍與實際能力相符[16]。該計畫預計於2026年第三季開放;現已有Advai、AIDX、安永(Ernst & Young)、Knovel Engineering、資誠(PwC)、Resaro、Vulcan等業者表達早期參與意願[17]。 參、事件評析 我國在AI評測上,已由數位發展部成立AI產品與系統評測中心(AIEC),就語言模型訂定安全性、可解釋性、彈性、公平性、準確性、透明性、當責性、可靠性、隱私與資安等10項評測指標[18]。針對語言模型之準確性、可靠性、資安、隱私、公平性進行技術評測,納入「臺灣價值觀」評測項目,以建立貼合本土社會脈絡之評測標準;規劃於2026年、2027年分別通過財團法人全國認證基金會(Taiwan Accreditation Foundation, TAF)認證[19]。 新加坡將其AI Verify評測方法提案成為ISO標準草案,並於前述國際會議中舉辦相關工作坊與研討活動,可見其認為任何AI評測須能成為國際共通接受之結果,始能在AI國際合規議題上達到評測之最大價值,因此其搶佔先機於ISO/IEC 42119系列中提出生成式AI之評測標準。我國AIEC之評測指標目前並未與數發部本身之風險分類框架相銜接,而數發部本身之風險分類框架亦可能與將來之國際標準存在落差。如AIEC測評結果須著眼於我國AI產品或服務之國際市場發展,即須追蹤觀測相關標準草案之進程,並同時就我國評測指標設計進行及時調整。 就測試方法而言,我國AIEC測評目前雖納入「臺灣價值觀」評測,但尚未就無法量化項目進行流程評測,亦無法對不同應用情境、代理AI動態運作過程進行風險評估。新加坡全球AI保證沙盒之報告已指出,生成式AI應用之測試須依風險輪廓調整、須檢視中間流程節點,此亦為我國AIEC測試做法須規劃補完之缺口。而新加坡推動AI測試業者認可計畫,則呈現其扶植本國AI測試服務業者、協助打開國際市場之思路;我國若欲就測試服務建立產業,則AIEC本身應設計成政府主導、建立標準、形成方法、認可適格業者之機制,同時由政府運用相關法令、獎補助、採購等方式提供市場誘因,將有助於落實我國AI基本法發展可信賴AI之宏旨。 本文著作權屬財團法人資訊工業策進會科技法律研究所所有,如需引用或轉載,請註明出處。 本文同步刊登於TIPS網站(https://www.tips.org.tw) [1]Singapore Champions New Global AI Testing Standardisation Efforts, ENTERPRISE SINGAPORE, Apr. 20, 2026, https://www.enterprisesg.gov.sg/resources/media-centre/media-releases/2026/april/mr01826_singapore-champions-new-global-ai-testing-standardisation-efforts (last visited Aug. 3, 2026). [2]ISO/IEC AWI TS 42119-8, Artificial Intelligence — Testing of AI — Part 8: Quality Assessment of Prompt-Based Text-to-Text Systems That Utilize Generative AI, ISO, https://www.iso.org/standard/91609.html (last visited Aug. 3, 2026). [3]ISO/IEC AWI TS 42119-8, Artificial Intelligence — Testing of AI — Part 8: Quality Assessment of Prompt-Based Text-to-Text Systems That Utilize Generative AI, ISO, https://www.iso.org/standard/91609.html (last visited Aug. 4, 2026)(該案於2025年9月13日登錄於ISO/IEC JTC 1/SC 42工作計畫,現為Stage 20.00「準備階段」/開發中,尚未定發布日期)。 [4]Singapore Champions New Global AI Testing Standardisation Efforts, ENTERPRISE SINGAPORE, Apr. 20, 2026, https://www.enterprisesg.gov.sg/resources/media-centre/media-releases/2026/april/mr01826_singapore-champions-new-global-ai-testing-standardisation-efforts (last visited Aug. 3, 2026). [5]ISO/IEC AWI TS 42119-8, Artificial Intelligence — Testing of AI — Part 8: Quality Assessment of Prompt-Based Text-to-Text Systems That Utilize Generative AI, ISO, https://www.iso.org/standard/91609.html (last visited Aug. 4, 2026)(42119-8屬ISO/IEC 42119「AI測試」系列,並銜接同系列42119-7與ISO/IEC 23282)。 [6]Singapore Champions New Global AI Testing Standardisation Efforts, ENTERPRISE SINGAPORE, Apr. 20, 2026, https://www.enterprisesg.gov.sg/resources/media-centre/media-releases/2026/april/mr01826_singapore-champions-new-global-ai-testing-standardisation-efforts (last visited Aug. 3, 2026). [7]AI Verify Testing Framework: For Traditional and Generative AI, AI VERIFY FOUNDATION, https://file.go.gov.sg/aivtf-pdf.pdf (last visited Aug. 4, 2026)(該框架第2頁明列前開11項治理原則)。 [8]What Is AI Verify, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/what-is-ai-verify/ (last visited Aug. 3, 2026). [9]AI Verify Testing Framework: For Traditional and Generative AI, AI VERIFY FOUNDATION, https://file.go.gov.sg/aivtf-pdf.pdf (last visited Aug. 4, 2026)。其中標示「Technical Testing」者計五項流程,分屬可解釋(第14頁)、安全(第29頁)、穩健(第61頁)、公平(第71、72頁)四原則;框架本身未另作總結性列舉。 [10]Project Moonshot, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/project-moonshot/ (last visited Aug. 3, 2026). [11]Singapore Unveils Insights from the World's First Technical Testing of Real-World Applications of GenAI, IMDA, May 29, 2025, https://www.imda.gov.sg/resources/press-releases-factsheets-and-speeches/press-releases/2025/sg-unveils-insights-from-worlds-first-technical-testing-of-real-world-applications-of-genai (last visited Aug. 3, 2026);Global AI Assurance Pilot, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/ai-assurance-pilot/ (last visited Aug. 3, 2026). [12]Global AI Assurance Sandbox, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/ai-assurance/ (last visited Aug. 3, 2026). [13]Executive Summary, Global AI Assurance Sandbox, AI VERIFY FOUNDATION, https://assurance.aiverifyfoundation.sg/main-report/ (last visited Aug. 3, 2026). [14]Executive Summary, Global AI Assurance Sandbox, AI VERIFY FOUNDATION, https://assurance.aiverifyfoundation.sg/main-report/ (last visited Aug. 3, 2026). [15]Media Factsheet on AI Assurance ─ AI Tester Accreditation Programme, AI VERIFY FOUNDATION, May 19, 2026, https://aiverifyfoundation.sg/wp-content/uploads/2026/05/Accreditation-Factsheet.pdf (last visited Aug. 4, 2026)。 [16]AI Tester Accreditation Programme, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/tester-accreditation/ (last visited Aug. 4, 2026);Media Factsheet on AI Assurance ─ AI Tester Accreditation Programme, AI VERIFY FOUNDATION, May 19, 2026, https://aiverifyfoundation.sg/wp-content/uploads/2026/05/Accreditation-Factsheet.pdf (last visited Aug. 4, 2026)(該計畫就技術能力、營運信譽、財務永續、營運量能、業務範圍相符五面向評估測試業者)。 [17]AI Tester Accreditation Programme, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/tester-accreditation/ (last visited Aug. 4, 2026);Media Factsheet on AI Assurance ─ AI Tester Accreditation Programme, AI VERIFY FOUNDATION, May 19, 2026, 但截至 2026/8/4 仍尚未見開放,https://aiverifyfoundation.sg/wp-content/uploads/2026/05/Accreditation-Factsheet.pdf (last visited Aug. 4, 2026)。 [18]〈數位發展部「AI產品與系統評測中心」啟動 推動我國AI評測制度與可信任AI環境發展〉,數位發展部數位產業署,2023年12月6日,https://moda.gov.tw/ADI/news/latest-news/9295(最後瀏覽日:2026/07/16);〈數位部AI評測中心啟動 語言模型納10項目評分〉,中央社,2023年12月6日,https://www.cna.com.tw/news/ait/202312060129.aspx(最後瀏覽日:2026/07/16)。 [19]〈AIEC首創「臺灣價值觀」評測指標 42款模型競爭揭示AI在地化關鍵〉,資安人科技網,2025年10月,https://www.informationsecurity.com.tw/article/article_detail.aspx?aid=12311(最後瀏覽日:2026/07/16)。