新加坡推動全球首部生成式AI測試國際標準—ISO/IEC 42119-8提案

新加坡推動全球首部生成式AI測試國際標準—ISO/IEC 42119-8提案

資訊工業策進會科技法律研究所

2026年08月04日

生成式AI快速普及,惟其輸出之品質、安全與可信賴程度如何檢驗,各國迄今尚無公認之測試標準。新加坡資訊通信媒體發展局(Infocomm Media Development Authority, IMDA)與新加坡企業發展局(Enterprise Singapore, EnterpriseSG)於2026年4月第17屆ISO/IEC JTC 1/SC 42人工智慧分技術委員會全體會議[1]中,公開《人工智慧—AI測試—第8部分:運用生成式AI之提示型文字對文字系統品質評估》(ISO/IEC AWI TS 42119-8)提案,並將其定位為全球首部就生成式AI系統測試方法而設之國際標準[2]。

壹、事件摘要

新加坡提出之ISO/IEC 42119-8,係運用其AI Verify與全球AI保證沙盒(Global AI Assurance Sandbox)累積之測試成果,以基準測試(benchmarking)與紅隊測試(red teaming)做為兩大檢測手段,所擬訂之生成式AI提示型文字對文字系統品質評估方法。該標準與同系列第7部分(ISO/IEC 42119-7)及ISO/IEC 23282相互銜接,於2025年9月已在ISO登錄,現處經核准工作項目(Approved Work Item)之準備階段,尚未定發布日期[3]。會議期間,新加坡並與美國國家標準協會、ISO國際組織及AI Verify基金會合作舉辦工作坊與交流會議,促其標準推進於國際間凝聚共識[4]。

貳、重點說明

一、ISO/IEC 42119系列以「AI測試」為主軸,第8部分處理生成式AI之品質評估

ISO/IEC 42119係ISO/IEC JTC 1/SC 42就AI系統之測試與保證新近規劃之AI測試共通方法系列標準[5]。該系列第8部分聚焦運用生成式AI之提示型文字對文字系統,涵蓋以紅隊測試進行之安全性檢測,並就評估結果之分析與記錄提供指引,並與同系列第7部分(紅隊測試,ISO/IEC 42119-7)及ISO/IEC 23282(自然語言處理系統評估方法)相互銜接。依主辦之IMDA與EnterpriseSG所述,該標準以提升測試結果之可重複性與可比較性為目標,藉基準測試與紅隊測試,使不同組織評估AI輸出品質時,結果更具一致性與可比較性,從而強化各界對AI系統之保證與信任[6]。

二、AI Verify以11項治理原則為基準,併行流程檢核與技術檢測

AI Verify係新加坡IMDA主導、由AI Verify基金會於2023年推動之開源測試框架,用以填補AI治理原則與可供稽核證據之間之落差。其以透明、可解釋、可重複、安全、資安、穩健、公平、資料治理、當責、人為監督,以及包容性成長(Inclusive Growth)、社會與環境福祉 (Societal and Environmental Well-being)11項治理原則為基準[7]。

AI Verify之檢驗分為流程檢核(Process Checks)與技術檢測(Technical Testing)。流程檢核依「原則、預期成效、流程、證據」(Principle, Outcome, Process, Evidence)四層展開檢核事項[8],要求擬測機構以文件證據佐證其治理流程確有落實,所需文件例如治理政策、模型與資料處理紀錄、內部審查程序等。各檢核項目中,於可解釋、安全、穩健、公平四項原則之部分檢視項目,並列有進行技術檢測的項目[9]。

三、以Project Moonshot工具對應生成式AI

AI Verify基金會的AI Verify框架原係以傳統AI為對象,為因應大型語言模型的檢測,其推出Project Moonshot做為前述技術檢測於生成式AI的主要測試工具。Moonshot提供逾100組基準資料集供進行基準測試,以分級評分評估模型在多種能力上的表現,例如語言與語境理解。Project Moonshot 亦提供自動化紅隊攻擊模組,可同時測試多個大型語言模型應用程式,節省時間與資源也確保模型效能的全面評估。Project Moonshot 的網頁介面並提供優化的測試流程,因應不同應用程式的多元需求,引導使用者只辨識並執行最相關的測試,使用者也可以利用自訂資料集調整測試,以評估模型是否符合其獨特使用情境[10]。

四、全球AI保證試點與沙盒媒合測試,以實測經驗作為標準前導

新加坡以全球AI保證機制(Global AI Assurance)串接前述工具與國際標準,由IMDA與AI Verify基金會共同主導,先後推出「試點(Global AI Assurance Pilot)」與「沙盒(Global AI Assurance Sandbox)」兩個措施。前者媒合生成式AI應用之開發者與專業測試業者(如Resaro、LatticeFlow AI、Advai等),就幻覺、不當內容、對抗弱點等風險進行技術測試。試點自2025年2月啟動,至同年5月彙整成果,已媒合17家應用部署者與16家測試業者[11]。後者則將試點之媒合做法予以常態化與擴大,使其自階段性試辦轉為長期運作之機制[12]。此機制屬軟性之自願測試,新加坡政府並不直接強制監管,而係以實作指引與測試媒合降低採用障礙、蒐集資料作為技術測試標準之前導、扶植AI保證服務市場[13]。

依IMDA的全球AI保證沙盒報告說明,其全球AI保證試點(Global AI Assurance Pilot)的AI測試焦點已從「基礎模型安全」移到「實際應用之端到端可靠性」,鑑於將基礎模型與現有資料來源、流程及系統整合的複雜度較高,生成式AI風險評估很大程度上取決於使用情境。該報告並歸納提出四個生成式AI評測的實務建議:測試優先序應依應用之風險輪廓調整,風險愈高者測試愈嚴;適格之測試資料集須由人與AI共同產製,兼顧代表性與品質;除最終輸出外,尚應檢視模型運作之中間流程節點;可運用大型語言模型協助評測,但須有人工校準,以免評分失真[14]。

五、AI測試業者認可計畫(AI TAP):從沙盒媒合走向測試供給端之制度化

前述試點與沙盒雖已媒合開發者與測試業者,惟受媒合之測試業者其資格良窳,仍多賴個案判斷。AI Verify Foundation爰於2026年5月19日發布「AI測試業者認可計畫」(AI Tester Accreditation Programme, AI TAP),規劃就測試業者本身設計認可基準,並建立合格測試業者名單,使企業採用外部測試服務時得有所依循[15]。

認可方式採取五個評估面向,包括測試AI風險之技術能力、營運信譽(含實績)、財務永續性、營運量能,以及所宣稱業務範圍與實際能力相符[16]。該計畫預計於2026年第三季開放;現已有Advai、AIDX、安永(Ernst & Young)、Knovel Engineering、資誠(PwC)、Resaro、Vulcan等業者表達早期參與意願[17]。

參、事件評析

我國在AI評測上,已由數位發展部成立AI產品與系統評測中心(AIEC),就語言模型訂定安全性、可解釋性、彈性、公平性、準確性、透明性、當責性、可靠性、隱私與資安等10項評測指標[18]。針對語言模型之準確性、可靠性、資安、隱私、公平性進行技術評測,納入「臺灣價值觀」評測項目,以建立貼合本土社會脈絡之評測標準;規劃於2026年、2027年分別通過財團法人全國認證基金會(Taiwan Accreditation Foundation, TAF)認證[19]。

新加坡將其AI Verify評測方法提案成為ISO標準草案,並於前述國際會議中舉辦相關工作坊與研討活動,可見其認為任何AI評測須能成為國際共通接受之結果,始能在AI國際合規議題上達到評測之最大價值,因此其搶佔先機於ISO/IEC 42119系列中提出生成式AI之評測標準。我國AIEC之評測指標目前並未與數發部本身之風險分類框架相銜接,而數發部本身之風險分類框架亦可能與將來之國際標準存在落差。如AIEC測評結果須著眼於我國AI產品或服務之國際市場發展,即須追蹤觀測相關標準草案之進程,並同時就我國評測指標設計進行及時調整。

就測試方法而言,我國AIEC測評目前雖納入「臺灣價值觀」評測,但尚未就無法量化項目進行流程評測,亦無法對不同應用情境、代理AI動態運作過程進行風險評估。新加坡全球AI保證沙盒之報告已指出,生成式AI應用之測試須依風險輪廓調整、須檢視中間流程節點,此亦為我國AIEC測試做法須規劃補完之缺口。而新加坡推動AI測試業者認可計畫,則呈現其扶植本國AI測試服務業者、協助打開國際市場之思路;我國若欲就測試服務建立產業,則AIEC本身應設計成政府主導、建立標準、形成方法、認可適格業者之機制,同時由政府運用相關法令、獎補助、採購等方式提供市場誘因,將有助於落實我國AI基本法發展可信賴AI之宏旨。

本文著作權屬財團法人資訊工業策進會科技法律研究所所有,如需引用或轉載,請註明出處。

本文同步刊登於TIPS網站(https://www.tips.org.tw)

 

[1]Singapore Champions New Global AI Testing Standardisation Efforts, ENTERPRISE SINGAPORE, Apr. 20, 2026, https://www.enterprisesg.gov.sg/resources/media-centre/media-releases/2026/april/mr01826_singapore-champions-new-global-ai-testing-standardisation-efforts (last visited Aug. 3, 2026).

[2]ISO/IEC AWI TS 42119-8, Artificial Intelligence — Testing of AI — Part 8: Quality Assessment of Prompt-Based Text-to-Text Systems That Utilize Generative AI, ISO, https://www.iso.org/standard/91609.html (last visited Aug. 3, 2026).

[3]ISO/IEC AWI TS 42119-8, Artificial Intelligence — Testing of AI — Part 8: Quality Assessment of Prompt-Based Text-to-Text Systems That Utilize Generative AI, ISO, https://www.iso.org/standard/91609.html (last visited Aug. 4, 2026)(該案於2025年9月13日登錄於ISO/IEC JTC 1/SC 42工作計畫,現為Stage 20.00「準備階段」/開發中,尚未定發布日期)。

[4]Singapore Champions New Global AI Testing Standardisation Efforts, ENTERPRISE SINGAPORE, Apr. 20, 2026, https://www.enterprisesg.gov.sg/resources/media-centre/media-releases/2026/april/mr01826_singapore-champions-new-global-ai-testing-standardisation-efforts (last visited Aug. 3, 2026).

[5]ISO/IEC AWI TS 42119-8, Artificial Intelligence — Testing of AI — Part 8: Quality Assessment of Prompt-Based Text-to-Text Systems That Utilize Generative AI, ISO, https://www.iso.org/standard/91609.html (last visited Aug. 4, 2026)(42119-8屬ISO/IEC 42119「AI測試」系列,並銜接同系列42119-7與ISO/IEC 23282)。

[6]Singapore Champions New Global AI Testing Standardisation Efforts, ENTERPRISE SINGAPORE, Apr. 20, 2026, https://www.enterprisesg.gov.sg/resources/media-centre/media-releases/2026/april/mr01826_singapore-champions-new-global-ai-testing-standardisation-efforts (last visited Aug. 3, 2026).

[7]AI Verify Testing Framework: For Traditional and Generative AI, AI VERIFY FOUNDATION, https://file.go.gov.sg/aivtf-pdf.pdf (last visited Aug. 4, 2026)(該框架第2頁明列前開11項治理原則)。

[8]What Is AI Verify, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/what-is-ai-verify/ (last visited Aug. 3, 2026).

[9]AI Verify Testing Framework: For Traditional and Generative AI, AI VERIFY FOUNDATION, https://file.go.gov.sg/aivtf-pdf.pdf (last visited Aug. 4, 2026)。其中標示「Technical Testing」者計五項流程,分屬可解釋(第14頁)、安全(第29頁)、穩健(第61頁)、公平(第71、72頁)四原則;框架本身未另作總結性列舉。

[10]Project Moonshot, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/project-moonshot/ (last visited Aug. 3, 2026).

[11]Singapore Unveils Insights from the World's First Technical Testing of Real-World Applications of GenAI, IMDA, May 29, 2025, https://www.imda.gov.sg/resources/press-releases-factsheets-and-speeches/press-releases/2025/sg-unveils-insights-from-worlds-first-technical-testing-of-real-world-applications-of-genai (last visited Aug. 3, 2026);Global AI Assurance Pilot, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/ai-assurance-pilot/ (last visited Aug. 3, 2026).

[12]Global AI Assurance Sandbox, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/ai-assurance/ (last visited Aug. 3, 2026).

[13]Executive Summary, Global AI Assurance Sandbox, AI VERIFY FOUNDATION, https://assurance.aiverifyfoundation.sg/main-report/ (last visited Aug. 3, 2026).

[14]Executive Summary, Global AI Assurance Sandbox, AI VERIFY FOUNDATION, https://assurance.aiverifyfoundation.sg/main-report/ (last visited Aug. 3, 2026).

[15]Media Factsheet on AI Assurance ─ AI Tester Accreditation Programme, AI VERIFY FOUNDATION, May 19, 2026, https://aiverifyfoundation.sg/wp-content/uploads/2026/05/Accreditation-Factsheet.pdf (last visited Aug. 4, 2026)。

[16]AI Tester Accreditation Programme, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/tester-accreditation/ (last visited Aug. 4, 2026);Media Factsheet on AI Assurance ─ AI Tester Accreditation Programme, AI VERIFY FOUNDATION, May 19, 2026, https://aiverifyfoundation.sg/wp-content/uploads/2026/05/Accreditation-Factsheet.pdf (last visited Aug. 4, 2026)(該計畫就技術能力、營運信譽、財務永續、營運量能、業務範圍相符五面向評估測試業者)。

[17]AI Tester Accreditation Programme, AI VERIFY FOUNDATION, https://aiverifyfoundation.sg/tester-accreditation/ (last visited Aug. 4, 2026);Media Factsheet on AI Assurance ─ AI Tester Accreditation Programme, AI VERIFY FOUNDATION, May 19, 2026, 但截至 2026/8/4 仍尚未見開放,https://aiverifyfoundation.sg/wp-content/uploads/2026/05/Accreditation-Factsheet.pdf (last visited Aug. 4, 2026)。

[18]〈數位發展部「AI產品與系統評測中心」啟動 推動我國AI評測制度與可信任AI環境發展〉,數位發展部數位產業署,2023年12月6日,https://moda.gov.tw/ADI/news/latest-news/9295(最後瀏覽日:2026/07/16);〈數位部AI評測中心啟動 語言模型納10項目評分〉,中央社,2023年12月6日,https://www.cna.com.tw/news/ait/202312060129.aspx(最後瀏覽日:2026/07/16)。

[19]〈AIEC首創「臺灣價值觀」評測指標 42款模型競爭揭示AI在地化關鍵〉,資安人科技網,2025年10月,https://www.informationsecurity.com.tw/article/article_detail.aspx?aid=12311(最後瀏覽日:2026/07/16)。

你可能會想參加
※ 新加坡推動全球首部生成式AI測試國際標準—ISO/IEC 42119-8提案, 資訊工業策進會科技法律研究所, https://stli.iii.org.tw/article-detail.aspx?d=9521&no=16&tp=1 (最後瀏覽日:2026/09/27)
引註此篇文章
你可能還會想看
國際海事組織建立海上自駕船舶監理架構

  國際海事組織(International Maritime Organization, IMO)所屬之海事安全委員會(Maritime Safety Committee, MSC)於2018年12月召開第100屆大會(MSC 100),本屆會議批准海上自駕船舶監管架構,要點如下: 一、盤點相關國際海事組織規範,以確認該規範: 是否適用於海上自駕船舶(Maritime Autonomous Surface Ships, MASS)及是否妨礙其運作與航行;或 是否適用於海事海上自駕船舶且不妨礙其運作;或 是否適用於海事海上自駕船舶且不妨礙其運作,但需要進一步調修。   MSC預計相關規範之盤點結論將於2019年6月前完成,並期待於2020年完成相關法規調適,盤點範圍包括:安全規範(SOLAS)、碰撞規範(COLREG)、載重線與穩度(Load Lines Convention)、海員與漁夫訓練(STCW, STCW-F)、搜尋與救援(SAR)、噸位丈量(Tonnage Convention)、貨櫃安全(CSC)、以及特殊貿易客船(SPACE STP, STP)。 二、 定義海上自駕船舶之自動化等級: 等級1:配備有自動化處理與決策支援船舶,海員仍於船上對船舶系統及相關功能進行控制。某些功能可以於無人監控下自動化運作,但船員於船舶上仍應於自動駕駛系統發生故障時進行人為介入。 等級2:有船員隨船之遙控控制船。該船舶係由岸上人員控制,惟船上之船員可於必要時介入並接手運作該船舶之自動駕駛系統與功能。 等級3:未有船員隨船之遙控控制船,該船舶由岸上人員控制。 等級4:全自動化船舶,船舶之自動駕駛系統可自行做出決策並反應。   此外,MSC預計提出海事海上自駕船舶航行指引(Guidelines on MASS trials),該指引將於下一會期(MSC101)之國際海事委員會會議進行草擬。

檢視《科學園區設置管理條例》暨相關規範對新創產業之租稅優惠

檢視《科學園區設置管理條例》暨相關規範對新創產業之租稅優惠 資訊工業策進會科技法律研究所 蔡立亭 法律研究員 2019年12月23日   《科學園區設置管理條例》於1979年訂立,並於2018年5月15日全文修正,同年6月6日公布。規範名稱由原先之《科學「工業」園區設置管理條例》更訂為《科學園區設置管理條例》(以下簡稱本條例),由傳統製造業為主體的思維,轉化為引進多元科學技術。   為鼓勵多元科技產業進入園區,本條例設有租稅優惠之規定,若自國外進口機器、設備、材料等,則可免徵進口稅、貨物稅、營業稅;外銷產品或勞務時,不僅營業稅的稅率為零,亦免徵貨物稅。[1]另外,尚有承租土地租金之減免;[2]以及輸出入貨品,若申請簽證、核准,則可免辦輸出入許可證。[3]在子法上,亦有園區進出口貨品保稅之規範。[4]申言之,進入園區的事業,仍須有實體的物件產出,方能適用本條例中的優惠。此仍偏屬於以工業的思維,規範園區內的產業,針對無實體產出的業者,如以大數據分析、服務為導向的新創事業,則不適用目前相關的租稅優惠。   在其他規範,[5]亦有輔助產業發展之租稅優惠。立於推動產業創新的基礎,針對遵守環境保護、勞工、食品安全衛生規範的企業;[6]或投資之全新智慧機械係供自行使用;[7]或於其自行研發之智慧財產權取得之收益範圍內讓與、授權,[8]均得抵減課徵所得稅。另,學術或研究機構自行研發,[9]或員工取得獎酬股份的基礎給付,[10]亦均得選擇免課徵所得稅。創業投資事業,[11]亦享有相關之租稅優惠。並尚有為生技新藥產業的升級,而在人才培訓、研究、發展的投資,可抵減營利事業所得稅。[12]針對中小企業對土地之使用、研發實驗、以智慧財產作價的股票、保留盈餘、增僱員工,[13]亦設有租稅優惠。現行的稅務規範,已不再侷限於空間或實體物,而有以鼓勵「研發」為主體。換言之,新創產業研發的各個階段,仍須以各自的技術、資金、人力形成研發成果,若能以政府的資源協助產品開發的過程,應可強化新創產業既有的研發基礎。   提供新創產業稅務上的支持,不僅可以直接補助新創業者的方式,亦可藉由鼓勵新創業者接受輔導,加速達成科技發展的目標。此可觀察美國《紐約洲商業孵化器與新創熱點支持法案》,[14]受孵化器輔導的新創公司,在個人所得稅、銷售與使用稅務、公司特許經營權的稅務上,具有利益。另,中國大陸對於重點發展的產業和專案,亦設有減稅、免稅等規定,[15]以提升科技發展。稅務上的優惠,已不再限於研發,而擴大及於「整體研發的過程」。   綜上所論,台灣政府為推動新創產業的發展,提供稅務上的優惠,以提升研發成果市場競爭力。若為加速科學研究的效率,或可參考美國、中國大陸以孵化器協助新創公司達成研發目標,制訂稅務優惠規範與接受輔導的要件等。 [1] 本條例第23條。 [2] 本條例第24條。 [3] 本條例第25條。 [4] 科學園區保稅業務管理辦法。 [5] 如中小企業發展條例、產業創新條例、生技新藥產業發展條例。 [6] 產業創新條例第10條。 [7] 產業創新條例第10條之1。 [8] 產業創新條例第12條之1。 [9] 產業創新條例第12條之2。 [10] 產業創新條例第19條之1。 [11] 產業創新條例第23條之1、第23條之2、第23條之3。 [12] 生技新藥產業發展條例第5條、第6條、第7條。 [13] 中小企業發展條例第4章:第33條至第36條之3。 [14] New York State Department of Taxation and Finance Taxpayer Guidance Division, New York State Business Incubator and Innovation Hot Spot Support Act, Technical Memorandum TSB-M-14(1)C, (1)I, (2)S, at 1-6 (March 7, 2014), URL:http://www.wnyincubators.com/content/Innovation%20Hot%20Spot%20Technical%20Memorandum.pdf (last visited:December 18, 2019). [15] 《中華人民共和國企業所得稅法》第4章「稅收優惠」:第25條至第36條(2008年修正)。

中國大陸公布「專利優先審查管理辦法」

  中國大陸國家知識產權局於2017年6月27日公布「專利優先審查管理辦法」,將自2017年8月1日起施行,對符合規定之發明、實用新型、外觀設計專利申請提供快速審查管道。同時廢止2012年之「發明專利優先審查管理辦法」,使優先審查制度之適用不再以發明專利為限。   按「專利優先審查管理辦法」第3條所揭,以下6種專利申請得請求優先審查: 涉及節能環保、新一代資訊技術、生物、高端裝備製造、新能源、新材料、新能源汽車、智慧製造等國家重點發展產業。 涉及各省級和設區的市級人民政府重點鼓勵的產業。 涉及互聯網、大數據、雲計算等領域且技術或者產品更新速度快。 專利申請人或者複審請求人已經做好實施準備或者已經開始實施,或者有證據證明他人正在實施其發明創造。 就相同主題首次在中國提出專利申請又向其他國家或者地區提出申請的該中國首次申請。 其他對國家利益或者公共利益具有重大意義需要優先審查。   作為中國大陸十三五時期所提出之智財法規,或可從中得知未來中國大陸重點發展之技術與智財領域。   台灣專利優先審查制度明訂於專利法第40條、第101條,惟智慧局得優先審查者,僅限於已公開之發明申請案有非專利申請人為商業上實施時或舉發案涉及侵權訴訟案件之審理者。適用對象、範圍與中國大陸優先審查制度有別,我國廠商、研發人員於大陸申請專利時,應予注意。 「本文同步刊登於TIPS網站(https://www.tips.org.tw)」

歐盟議會否決法國所提出切斷網路連接的修正條款

  法國政府基於保護電影、音樂等產業,在2009年3月提出將採取「三振法案」(Three-strikes law),對於不法使用網路下載音樂和檔案者,祭出明確的管制。第一階段違法者將會收到電子郵件警告,第二階段會收到書面之警告,第三階段將切斷該網路連接最長1年。   但這個提議在2009年4月遭到法國議會否決,有議員表示這項規定是「危險、無用、無效率且對民眾有相當大之危險。」消費者團體則表示,「無辜的民眾將會受到處罰,而駭客等真正的犯罪者則可以利用入侵他人之帳號規避法規,而且,該架構顯然缺乏配套的監督機制。」   無獨有偶的是,歐洲議會(European Parliament)也在同年11月針對歐盟電信信改革(EU Telecoms Reform)之討論,駁回該議案。議會認為,對人民通過網路使用服務和應用而進行的網際網路連接行為,在採取的措施時,應該尊重基本的人權和自由。這些限制權利的手段必須符合民主社會的法規,必須有效、公平和公正,比如通過法院進行審理等。而法國所提之切斷網路連接的三振法案與此原則不符。

TOP