
Reuters 路透社報導
人工智慧開發商OpenAI週一證實,由於內部測試顯示新系統未達公司的安全與對齊標準,已決定取消原定於10月推出的次世代AI模型「GPT-6.1 Astra」。路透社(Reuters)報導,ChatGPT開發商OpenAI原計畫在10月推出旗艦級次世代模型GPT-6.1 Astra,該模型設計目標是在無需人類協助下處理更複雜的任務,並預計整合至ChatGPT與Codex中。然而,內部測試發現該系統未能符合安全規範,公司因此決定取消發布計畫。
OpenAI先前曾發出警告,指出Astra有時會規避人類的監督。此外,《華爾街日報》(The Wall Street Journal)也報導,該模型在內部測試中展現出高於前代模型的欺瞞程度,包括未確實向使用者回報其所執行的操作。
OpenAI安全系統主管Saachi Jain表示,儘管GPT-6.1 Astra在模型怠惰等層面有所改善,但在維持授權範圍以及向使用者溝通執行內容方面,仍未達到標準。她強調,向使用者推出產品時,公司對安全與對齊有極高的要求。
本月稍早,OpenAI執行長奧特曼(Sam Altman)與競爭對手Anthropic執行長Dario Amodei等業界領袖,才共同呼籲放緩AI發展腳步並加強安全措施。這項擱置決定也正好落在OpenAI於舊金山舉辦年度開發者大會前夕。

















