OpenAI, 지저분하고 판단이 많이 필요한 생물학 연구를 AI가 감당할 수 있는지 테스트하는 GeneBench-Pro 출시
OpenAI가 생물학 워크플로에서 AI 에이전트가 연구 수준의 판단을 내릴 수 있는지 측정하는 유전체 벤치마크 GeneBench-Pro를 공개했다.
OpenAI가 생물학 워크플로에서 AI 에이전트가 연구 수준의 판단을 내릴 수 있는지 측정하는 유전체 벤치마크 GeneBench-Pro를 공개했다.
OpenAI는 GPT-5.6 Sol을 미리 공개하며, 이를 코딩, 과학, 사이버보안에서 더 강력한 성능을 갖춘 차세대 모델이자 자사가 말하는 가장 진보된 안전 스택을 함께 갖춘 모델이라고 설명했다. 현재까지 공개된 정보는 제한적이지만, 이번 발표의 의미는 벤치마크의 세부 수치보다 더 크다. OpenAI가 빌더와 기업 고객을 끌어들이는 과정에서 최첨단 모델의 성능 향상에 점점 더 명시적인 안전성 포지셔닝을 결합하고 있음을 보여주기 때문이다.
Anthropic의 초기 투자자 한 명이 회사의 IPO 경로, OpenAI와의 경쟁, 그리고 더 넓은 AI 최전선의 기회에 대해 이야기했다.
Anthropic은 OpenAI, Google, Cloudflare 및 기타 개발자들을 위해 API에서 SDK를 생성하는 것으로 알려진 스타트업 Stainless를 인수했다.
TechCrunch는 AI로 인한 부가 소수에게 집중되는 한편 소프트웨어 종사자들은 불확실성에 직면하고 있다는 우려를 보도했다.
OpenAI와 몰타는 자격이 되는 시민들에게 1년간 ChatGPT Plus 이용권을 제공하는 국가 AI 리터러시 프로그램을 발표했습니다.
TechCrunch는 머스크 대 알트만 재판이 마무리됐으며, 변론은 AI 기업을 이끄는 사람들에 대한 신뢰를 중심으로 진행됐다고 전했다.
OpenAI는 에이전트형 제품을 향해 나아가며 ChatGPT, Codex, API 제품 업무를 Greg Brockman 아래로 통합하고 있다.
Thinking Machines Lab의 창립자 미라 무라티는 WIRED에 자신의 회사가 사람을 대체하는 자동화가 아니라 협업형 AI를 만들고 있다고 말했다.
OpenAI의 코딩 에이전트 Codex가 이제 ChatGPT의 iOS 및 Android 앱에서 미리보기로 제공됩니다.
프런티어 모델에 대한 최신 뉴스 및 분석