路透:中國AI開發商僅對3.6%已發表模型公布安全測試
全球日益關注先進人工智慧(AI)系統的風險之際,根據科技研究機構SemiAnalysis,中國主要AI開發商僅對極少數已發表的模型公布具體的安全測試結果,比重僅占3.6%。

中國主要AI開發商僅對極少數已發表的模型公布具體的安全測試結果,比重僅占3.6%。路透
AI摘要 文章摘要整理: SemiAnalysis指出,中國9大AI開發商在857個已發表模型中,僅少數公開具體安全測試結果,顯示安全資訊揭露相當有限。
SemiAnalysis指出,中國9大AI開發商在857個已發表模型中,僅少數公開具體安全測試結果,顯示安全資訊揭露相當有限。
全球日益關注先進人工智慧(AI)系統的風險之際,根據科技研究機構SemiAnalysis,中國主要AI開發商僅對極少數已發表的模型公布具體的安全測試結果,比重僅占3.6%。
路透報導,SemiAnalysis審視中國9大AI業者在2021年至今年9月15日期間合計發表的857個模型,這些企業包含 阿里巴巴 、 字節跳動 、騰訊、 百度 、深度求索(DeepSeek)、月之暗面(Moonshot AI)、智譜(Z.AI)、MiniMax,以及階躍星辰(StepFun)。
報告發現,31個已發表模型公開可與具體模型對應的安全評估結果,占比為3.6%。另有9個模型在發表或發表前即已公布這類結果,占比為1.1%。
研究人員指出,有813個模型並未揭露安全相關資訊,不過這些企業仍有可能在內部進行測試。
SemiAnalysis表示,對「資訊揭露」的定義是指與特定模型有關連的具體結果,包括對有害輸出、越獄防禦能力、毒性、隱私、拒絕回應或危險功能的測試,這些不包含已接受安全訓練或評估的一般聲明。
SemiAnalysis補充說,尚未有中國主要開發商發表涵蓋網路、生物或失控風險等公開測試結果的前沿文字模型。
精華 FAQ Q1:中國主要AI開發商公布模型安全測試的比例有多低? 根據SemiAnalysis的統計,中國9大AI業者在2021年至今年9月15日發表的857個模型中,僅有31個公開可對應到具體模型的安全評估,比例只有3.6%。 Q2:這份報告如何定義模型安全資訊的資訊揭露? SemiAnalysis所稱的資訊揭露,是指與特定模型直接相關的具體測試結果,例如有害輸出、越獄防禦、毒性、隱私、拒絕回應或危險功能等,而不只是一般性的安全訓練聲明。 Q3:報告對中國前沿文字模型的公開安全測試有何結論? SemiAnalysis補充指出,目前尚未看到中國主要開發商發表涵蓋網路、生物或失控風險等公開測試結果的前沿文字模型,顯示高風險安全評估仍相當不足。
Q1:中國主要AI開發商公布模型安全測試的比例有多低? 根據SemiAnalysis的統計,中國9大AI業者在2021年至今年9月15日發表的857個模型中,僅有31個公開可對應到具體模型的安全評估,比例只有3.6%。
Q1:中國主要AI開發商公布模型安全測試的比例有多低?
根據SemiAnalysis的統計,中國9大AI業者在2021年至今年9月15日發表的857個模型中,僅有31個公開可對應到具體模型的安全評估,比例只有3.6%。
Q2:這份報告如何定義模型安全資訊的資訊揭露? SemiAnalysis所稱的資訊揭露,是指與特定模型直接相關的具體測試結果,例如有害輸出、越獄防禦、毒性、隱私、拒絕回應或危險功能等,而不只是一般性的安全訓練聲明。
Q2:這份報告如何定義模型安全資訊的資訊揭露?
SemiAnalysis所稱的資訊揭露,是指與特定模型直接相關的具體測試結果,例如有害輸出、越獄防禦、毒性、隱私、拒絕回應或危險功能等,而不只是一般性的安全訓練聲明。
Q3:報告對中國前沿文字模型的公開安全測試有何結論? SemiAnalysis補充指出,目前尚未看到中國主要開發商發表涵蓋網路、生物或失控風險等公開測試結果的前沿文字模型,顯示高風險安全評估仍相當不足。
Q3:報告對中國前沿文字模型的公開安全測試有何結論?
SemiAnalysis補充指出,目前尚未看到中國主要開發商發表涵蓋網路、生物或失控風險等公開測試結果的前沿文字模型,顯示高風險安全評估仍相當不足。
中監測:超強聖嬰現象已形成 秋末冬初達到峰值