OpenAIがGeneBench-Proを公開、AIが厄介で判断力を要する生物学研究に対応できるかをテスト
OpenAIは、AIエージェントが生物学ワークフローで研究レベルの判断を下せるかを測るためのゲノミクス・ベンチマーク、GeneBench-Proを発表した。
OpenAIは、AIエージェントが生物学ワークフローで研究レベルの判断を下せるかを測るためのゲノミクス・ベンチマーク、GeneBench-Proを発表した。
OpenAI は GPT-5.6 Sol をプレビュー公開し、コーディング、科学、サイバーセキュリティでより高い性能を発揮する次世代モデルであり、同社が「最も先進的」とする安全対策スタックも備えていると説明した。現時点で公開されている情報は限定的だが、この発表の重要性はベンチマークの細かな数値そのものよりも、そこから読み取れるメッセージにある。OpenAI は、フロンティアモデルの能力向上と、より明確な安全性の打ち出しを引き続き両立させ、開発者や企業顧客の獲得を狙っている。
Anthropicの初期投資家は、同社のIPOへの道筋、OpenAIとの競争、そしてAIフロンティアにおけるより広範な機会について語った。
Anthropicは、OpenAI、Google、Cloudflareなどの開発者向けにAPIからSDKを生成することで知られるスタートアップStainlessを買収した。
TechCrunchは、AIによる富が少数の集団に集中する一方で、ソフトウェア業界の労働者が不確実性に直面しているという懸念を報じている。
OpenAIとマルタは、対象となる国民に1年間のChatGPT Plusアクセスを提供する国家AIリテラシープログラムを発表した。
TechCrunchによると、マスク対アルトマンの裁判は、AI企業を率いる人々への信頼をめぐる議論が中心となって閉廷した。
OpenAIは、エージェント型製品に向けて進む中で、ChatGPT、Codex、APIの製品業務をGreg Brockmanの下に統合している。
Thinking Machines Lab の創業者ミラ・ムラティ氏は WIRED に対し、同社は人を置き換える自動化ではなく、協働型 AI を構築していると語った。
OpenAIのコーディングエージェントCodexが、ChatGPTのiOSおよびAndroidアプリ内でプレビューとして利用可能になりました。
フロンティアモデルに関する最新ニュースと分析