← 返回新闻首页
台湾权威

美媒:OpenAI取消發表GPT-6.1 Astra 內部測試發現模型有欺瞞行為

「華爾街日報」今天報導,OpenAI因研究人員在內部測試中發現安全疑慮,決定取消原定於10月亮相的次世代人工智慧(AI)模型GPT-6.1 Astra發表計畫。

台湾中央社蔡佳敏查看原文 ↗
美媒:OpenAI取消發表GPT-6.1 Astra 內部測試發現模型有欺瞞行為

OpenAI因在內部測試中發現安全疑慮,取消原定於10月亮相的AI模型GPT-6.1 Astra發表計畫。(路透社)

(中央社華盛頓28日綜合外電報導)「華爾街日報」今天報導,OpenAI因研究人員在內部測試中發現安全疑慮,決定取消原定於10月亮相的次世代人工智慧(AI)模型GPT-6.1 Astra發表計畫。

華爾街日報(The Wall Street Journal)報導指出,這款模型原預計應用於ChatGPT與Codex,設計目的是讓AI能在無需人類協助下處理更複雜的任務。

近幾個月來,業界陸續傳出AI系統失控的報告;OpenAI這次因安全疑慮取消新模型發表,在大型AI開發商中相當罕見。

OpenAI接下來將把重心放在提升未來模型的安全性,並預期未來模型的能力將更為強大。

OpenAI負責安全的主管詹恩(Saachi Jain)今天告訴「華爾街日報」,Astra在評估系統是否能遵循人類意圖的測試中,未符合公司標準。

報導指出,Astra顯示出比前一代更高的欺瞞行為,包括有時未能如實揭露自己已進行或未執行的操作。

此外,Astra在「範圍授權」方面也出現問題,會在未請求用戶許可的情況下繼續執行任務,有時甚至會在可能存在風險時,嘗試使用外部工具或服務。

這項決定是在OpenAI即將於美國加州舊金山(San Francisco)舉行開發者大會前作出的。

OpenAI上週才表示,由於某個AI代理人突破網路限制並查詢公開聊天機器人,公司已暫停訓練能力最強的AI模型。不過,OpenAI表示,GPT-6.1 Astra並非這批模型,而是另一個案例。

OpenAI表示正調查近幾個月發現的多起AI代理人安全事件,並已導入新的監控系統,以更快發現AI代理人的異常行為,同時要求工程師在測試系統時採用更嚴格的安全防護措施。

路透社報導,本月稍早,Anthropic執行長阿莫戴(Dario Amodei)呼籲業界放慢先進AI模型的開發腳步,讓安全措施得以跟上;他的觀點獲得OpenAI執行長阿特曼(Sam Altman)及太空探索科技公司(SpaceX)執行長馬斯克(Elon Musk)的支持。

OpenAI未立即回應路透社的置評請求。

儘管決定不按原計畫推出Astra,OpenAI仍希望以相同基礎模型進行更多強化學習,並用於打造後續GPT-6系列模型。(編譯: 蔡佳敏 )1150929

選擇與事實站在一起,您的每一份贊助,都是守護新聞自由的力量

下載中央社「一手新聞」APP,即時掌握最新消息

本網站之文字、圖片及影音,非經授權,不得轉載、公開播送或公開傳輸及利用。

手机左右滑动,电脑按 ← → 键,也能切换新闻