OpenAI 表示,Responses API 的兩個設定大幅改善了 GPT-5.6 Sol 在 ARC-AGI-3 的表現
OpenAI 指出,保留推理與壓縮讓 GPT-5.6 Sol 的 ARC-AGI-3 分數幾乎提升 3 倍,凸顯 harness 設計如何塑造 AI 基準測試。
OpenAI 指出,保留推理與壓縮讓 GPT-5.6 Sol 的 ARC-AGI-3 分數幾乎提升 3 倍,凸顯 harness 設計如何塑造 AI 基準測試。
來自 The National CIO Review 的一則報導稱,OpenAI 已將 GPT-5.6 納入一項新的企業 AI 模型策略。由於來源群組中沒有可用的第一手產品材料,最清楚的結論偏向策略面而非技術面:OpenAI 似乎正在更精準地規劃其面向企業買家的模型包裝方式。這一點很重要,因為企業 AI 的採用越來越受到定價、控制、可靠性與工作流程適配性的影響,而不只是原始基準測試表現。
OpenAI 預覽了 GPT-5.6 Sol,將其描述為一款下一代模型,在程式設計、科學與網路安全方面擁有更強表現,同時配備其所稱最先進的安全防護堆疊。由於目前公開的細節仍相當有限,這項公告的重要性與其說在於基準測試的具體數字,不如說在於它所傳達的訊號:OpenAI 持續將前沿模型能力的提升,與愈來愈明確的安全定位結合,藉此吸引開發者與企業買家。
Storyboard18 的報導指出,OpenAI 的下一次模型發布可能會聚焦於 GPT-5.6,以及三個名為 Sol、Terra 和 Luna 的變體。不過,由於所提供的證據中沒有可取得的一手來源公告,這則消息與其說是已確認的產品規格,不如說是在觀察市場如何對 OpenAI 另一項潛在模型分層舉措作出反應。對開發者與企業買家而言,關鍵不在於名稱本身,而在於 OpenAI 是否正準備一個更細分的產品陣容,以因應不同的成本、延遲與推理需求。
OpenAI 更新 的最新新聞與分析