OpenAI 推出 GeneBench-Pro,測試 AI 能否應付混亂、重判斷的生物學研究
OpenAI 釋出 GeneBench-Pro,一項基因體學基準,旨在衡量 AI agent 是否能在生物學工作流程中做出研究等級的判斷。
OpenAI 釋出 GeneBench-Pro,一項基因體學基準,旨在衡量 AI agent 是否能在生物學工作流程中做出研究等級的判斷。
OpenAI 預覽了 GPT-5.6 Sol,將其描述為一款下一代模型,在程式設計、科學與網路安全方面擁有更強表現,同時配備其所稱最先進的安全防護堆疊。由於目前公開的細節仍相當有限,這項公告的重要性與其說在於基準測試的具體數字,不如說在於它所傳達的訊號:OpenAI 持續將前沿模型能力的提升,與愈來愈明確的安全定位結合,藉此吸引開發者與企業買家。
模型 的最新新聞與分析