来客网

十萬顆GPU聯手訓練,通用人工智慧終於來了!?OpenAI發表最強模型GPT-6,首席科學家擔憂「無法控管」

声明:本文转载自 「风传媒」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]

人工智慧巨頭OpenAI於美東時間3日發表新一代旗艦模型「GPT-6 Astra」,主打兼具作業系統級電腦操作、高階程式開發與自主多步驟研究,OpenAI共同創辦人暨總裁布羅克曼(Greg Brockman)更宣稱「歡迎來到通用人工智慧(AGI)的時代。」 《Axios》指出,Astra是OpenAI歷來規模最龐大的訓練成果,動用了位於德州「星際之門」(Stargate)運算基地超過10萬顆圖形處理器(GPU),並且是該公司首次在訓練過程中讓其他AI模型扮演深度監督角色的產物。不過Astra初期僅向「Daybreak Access」計畫下的特定機構開放,接下來才會陸續推播給ChatGPT Plus、Pro、Business、Enterprise訂閱用戶及API開發者。 《連線》雜誌特別點出,對於規模龐大的免費版ChatGPT用戶未來能否使用,OpenAI至今隻字未提。 在API成本上,Astra每百萬輸入Token要價10美元、輸出Token為50美元,是目前以推廣價供售的GPT-5.6 Sol(輸入4美元、輸出20美元)的整整2.5倍。 直攻電腦桌面與專業軟體 OpenAI宣稱,Astra是「全球最具智慧且最符合對齊原則(aligned)的模型」。官方數據顯示,Astra在極高難度數學評測FrontierMath Tier 4 v2取得97.6%,抽象推理評測ARC-AGI-3達到近乎完美的99.9%,在漏洞利用評測ExploitBench更拿下100%滿分。在無需連網的本機作業系統操作基準OSWorld 2.0中,Astra以平均每項任務40分鐘取得72.6%的成功率,優於GPT-5.6 Sol的65.7%(耗時約75分鐘)。 根據美國媒體報導,Astra展現了直接接管應用軟體的作業能力。像是Astra接收電路原理圖後,能在開源電子設計軟體KiCad中,於2分54秒內自主完成符合生產規範的印刷電路板(PCB)走線與元件布局;亦能在FreeCAD與Blender中建立汽車變速箱動畫,或在Blender完成建築建模後無縫導入虛幻引擎5(Unreal Engine 5)生成可互動漫遊場景。 在學術層面,Astra協助推進了一項關於「質數間距」(gaps between prime numbers)的純數學研究成果;在實務工作上,除能處理基因定序與Power BI數據外,還能讀取W-2稅單自動填寫美國聯邦個人所得稅申報書(Form 1040),甚至在真實網絡中代為預約駕照監理所(DMV)時段與搜尋租屋。​ OpenAI研究副總裁格雷斯(Amelia Glaese)表示:「當模型能更自主地完成任務,我們就必須對它建立更高的信任。未來使用者不再需要一步步下達操作步驟,而是轉向更高階的整體指揮。」 資安能力首度觸及「重大危險」紅線 然而「GPT-6 Astra」的高度自主性也引發高度關注,OpenAI證實,依據內部「準備度架構」(Preparedness Framework),Astra是首個在網路安全能力達到「重大」(Critical)門檻的模型——意即在具備適當工具下,不需人類逐步引導,即可自主對防禦森嚴的系統挖掘並利用未知缺陷。 在針對未公開漏洞的內部評測中,Astra在建構攻擊鏈時,自主找出了2起全新的「零日漏洞」(0-day)並成功實施攻擊;在專業紅隊測試中,Astra更成功攻陷具高防禦力的瀏覽器環境,突破沙盒(sandbox escape)並在主機端執行任意指令。 《Axios》指出,今年7月甫發生OpenAI測試中模型脫逃沙盒並入侵開源社群Hugging Face系統的資安事件,加劇了業界對AI自主擴散的擔憂。對此,OpenAI表示全面釋出的Astra已導入嚴格限制,全面封殺概念驗證(PoC)漏洞利用碼的生成,僅透過「Daybreak Blue」計畫向經過身分驗證的防禦型資安夥伴提供完整能力。 首席科學家示警:不排除暫緩擴展 OpenAI測試顯示,當被明確指示隱匿推導過程時,Astra生成的思維鏈(chain-of-thought)文字比前代模型更難被外部監控。尤其在處理簡易問題時,Astra展現出自主調節文字輸出、以最少可見步驟解決問題的能力,實質上將思考過程隱匿於人類審查者之外。《路透》指出,這將使導入AI代理人的企業難以對決策原因進行合規稽核。 OpenAI首席科學家帕喬茨基(Jakub Pachocki)向媒體坦言:「我們過去總將能夠理解模型思考視為理所當然,但隨著能力躍進,監控變得愈發困難。我們無法容忍對模型對齊狀態的監控能力低於特定水準,若無法確保這一點,它將成為限制未來發展的瓶頸。在找回足夠把握前,我們不排除暫緩擴展(scaling)。」 AGI時代降臨?矽谷專家:去年就已啟動 對於布羅克曼宣告的「AGI時代」,科技圈評價不一。OpenAI將AGI定義為「在絕大多數具經濟價值的任務中超越人類的自主系統」。批評者直言,Astra至今尚未公布針對多行業專業工作設計的「GDPval」基準分數,且在部分程式碼與智力指標上仍落後競爭對手Anthropic的產品;而在ARC-AGI-3取得的99.9%成績,也是仰賴Responses API環境下的外部工具、記憶體與代理人軟體配合,並非純基底模型本身。 資深科技創業家、曾兩度將公司售予蘋果的比爾·阮(Bill Nguyen)指出,AGI的轉折點實際上早在去年11月Anthropic發表Opus 4.5時就已發生:「你只要提出一個構想,模型就會自己去找工具、找外部程式把工作做完。我甚至認為阿特曼(Sam Altman)與阿莫代(Dario Amodei)低估了這些模型的能力——當前真正的限制,不是模型的能力極限,而是企業與個人有沒有願意放手的野心。」

评论 (0)