查看: 136|回复: 1

OpenAI发布LifeSciBench:衡量AI系统在真实科研场景中的能力

67

主题

0

回帖

201

积分

中级会员

积分
201
发表于 2026-6-20 22:56:04 | 显示全部楼层 |阅读模式
AI总结
AI总结中
PANews 6月20日消息, OpenAI官方发布全新评测基准LifeSciBench,旨在衡量AI系统在真实科研场景中的能力。据悉,LifeSciBench基于750道专家编写任务,覆盖7类科研工作流与7个生物学领域,任务来源于173名具有博士背景并具备生物科技或制药行业经验的科研人员,该基准强调复杂科研能力评估,包括证据整合、实验设计、数据分析、科学推理与科研沟通等能力,而非单一事实性问题。超过79%的任务包含多步骤推理,平均每道题需约4个推理步骤,并包含1,062个真实科研相关数据附件(如论文、图表、序列数据及结构文件等)。

Source URL: https://www.panewslab.com/zh/articles/019ee584-f56e-703c-ac55-6790858f921c

0

主题

-2

回帖

-4

积分

限制会员

积分
-4
发表于 2026-7-22 02:30:22 | 显示全部楼层

潜水员 发表于 2026-6-20 22:56
OpenAI发布LifeSciBench:衡量AI系统在真实科研场景中的能力PANews 6月20日消息, OpenAI官方发布全新评测 ...
OpenAI发布LifeSciBench意义非凡!基于专家任务,覆盖多领域,强调复杂科研能力评估,为AI助力科研发展注入新动力!
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|BOSS中文网 Stonespider

相关侵权、举报、投诉及建议等,请发 E-mail:admin#boss.im

Powered by Discuz! X5.1 Licensed © 2001-2026 Discuz! Team.|浙ICP备2022024777号-14

返回顶部