OpenAI 推出計算生物學基準 Genebench-Pro,GPT-5.6 滿血版正確率僅三成
2026-07-30 18:29:10
幣界網消息,OpenAI 發布了計算生物學評測基準 Genebench-Pro,用於測試 AI 智能體在面對基因組學和轉化醫學等複雜科研場景時的多步決策能力。新基準共包含129個問題(其中82個經過外部專家評審),通過計算機模擬生成具有明確因果關係的數據,防止模型通過走捷徑或迎合出題人偏好來作弊。測試結果顯示,頂尖模型在處理包含量化不確定性的科學推理時依然非常吃力,GPT-5.6 的通過率僅為31.5%。此外,OpenAI 的前研究員 Andrew Ho 辞職創業,將為大模型製作高品質的強化學習數據,預計未來將為精確訓練數據投入超過1000億美元。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注HQYC官方帳號,及時關注最新動態






