Artificial intelligence systems for scientific discovery have demonstrated remarkable potential, yet existing approaches remain largely proprietary and operate in batch-processing modes requiring hours per research cycle, precluding real-time researcher guidance. This paper introduces Deep Research, a multi-agent system enabling interactive scientific investigation with turnaround times measured in minutes. The architecture comprises specialized agents for planning, data analysis, literature search, and novelty detection, unified through a persistent world state that maintains context across iterative research cycles. Two operational modes support different workflows: semi-autonomous mode with selective human checkpoints, and fully autonomous mode for extended investigations. Evaluation on the BixBench computational biology benchmark demonstrated state-of-the-art performance, achieving 48.8% accuracy on open response and 64.4% on multiple-choice evaluation, exceeding existing baselines by 14 to 26 percentage points. Analysis of architectural constraints, including open access literature limitations and challenges inherent to automated novelty assessment, informs practical deployment considerations for AI-assisted scientific workflows.


翻译:科学发现人工智能系统已展现出显著潜力,但现有方法仍主要采用专有架构并以批处理模式运行,每个研究周期需耗时数小时,无法实现研究人员的实时指导。本文提出Deep Research多智能体系统,该系统支持分钟级响应的交互式科学研究。该架构包含规划、数据分析、文献检索和新颖性检测等专用智能体,通过持久化世界状态进行统一协调,在迭代研究周期中保持上下文连贯性。系统提供两种运行模式以支持不同工作流:包含选择性人工检查点的半自主模式,以及适用于长期探索的全自主模式。在BixBench计算生物学基准测试中的评估表明,系统在开放回答任务上达到48.8%准确率,多项选择任务上达到64.4%准确率,较现有基线提升14至26个百分点,实现了最先进的性能表现。通过对架构约束(包括开放获取文献的局限性及自动化新颖性评估的固有挑战)的分析,为人工智能辅助科学工作流的实际部署提供了实践指导。

0
下载
关闭预览

相关内容

从面向科学的人工智能到智能体科学:自主科学发现综述
Agent AI:多模态交互的新地平线
专知会员服务
21+阅读 · 2025年5月26日
【NUS博士论文】面向交互的多智能体行为预测,156页pdf
专知会员服务
32+阅读 · 2024年11月17日
【AI4Science】《人工智能科学:深度学习革命》2023新书,
专知会员服务
214+阅读 · 2023年6月15日
【2023新书】AI4Science,人工智能促进科学发现,134页pdf
专知会员服务
204+阅读 · 2023年4月5日
综述AI未来:神经科学启发的类脑计算
人工智能学家
11+阅读 · 2018年4月24日
群体智能:新一代人工智能的重要方向
走向智能论坛
12+阅读 · 2017年8月16日
国家自然科学基金
7+阅读 · 2017年12月31日
国家自然科学基金
6+阅读 · 2017年12月31日
国家自然科学基金
3+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2014年12月31日
国家自然科学基金
10+阅读 · 2013年12月31日
国家自然科学基金
21+阅读 · 2013年12月31日
国家自然科学基金
18+阅读 · 2009年12月31日
国家自然科学基金
49+阅读 · 2009年12月31日
国家自然科学基金
17+阅读 · 2008年12月31日
VIP会员
最新内容
《系统簇式多域作战规划范畴论框架》
专知会员服务
2+阅读 · 今天14:54
高效视频扩散模型:进展与挑战
专知会员服务
0+阅读 · 今天13:34
乌克兰前线的五项创新
专知会员服务
6+阅读 · 今天6:14
 军事通信系统与设备的技术演进综述
专知会员服务
4+阅读 · 今天5:59
《北约标准:医疗评估手册》174页
专知会员服务
4+阅读 · 今天5:51
《提升生成模型的安全性与保障》博士论文
专知会员服务
4+阅读 · 今天5:47
美国当前高超音速导弹发展概述
专知会员服务
4+阅读 · 4月19日
无人机蜂群建模与仿真方法
专知会员服务
13+阅读 · 4月19日
相关基金
国家自然科学基金
7+阅读 · 2017年12月31日
国家自然科学基金
6+阅读 · 2017年12月31日
国家自然科学基金
3+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2014年12月31日
国家自然科学基金
10+阅读 · 2013年12月31日
国家自然科学基金
21+阅读 · 2013年12月31日
国家自然科学基金
18+阅读 · 2009年12月31日
国家自然科学基金
49+阅读 · 2009年12月31日
国家自然科学基金
17+阅读 · 2008年12月31日
Top
微信扫码咨询专知VIP会员