论文解读|DuMate-DeepResearch:国产 DeepResearch 代理在 DeepResearch Bench 拿下 58.03%
本周 arXiv 出现一篇让中文 AI 圈振奋的论文:2606.07299,DuMate-DeepResearch。来自中国团队的开源 DeepResearch 代理在 Hugging Face 公认的 DeepResearch Bench(DRB)上拿到 58.03% 分数。
DeepResearch Bench 是什么?
DRB 由 Hugging Face 发布,是目前最严格的「深度研究」评测。它不是简单问答,而是给模型一个开放式研究问题,模型必须:
- 自主拆解研究问题
- 规划多步搜索
- 阅读 50-200 个网页/PDF
- 综合、引用、形成结构化报告
- 事实核查 + 反例考虑
OpenAI Deep Research 当前 ~64%,Claude Research ~52%,Gemini Deep Research ~49%。
DuMate-DeepResearch 的技术亮点
虽然具体架构未完全公开,从论文摘要和 README 可以看出几个关键点:
- 动态任务分解:不是固定工作流,而是每步根据当前信息再决定下一步
- 异步并行搜索:用 asyncio 同时发起多个搜索,节省 40% 时间
- 证据置信度评估:对每个引用的来源打分,低于阈值的不进入最终报告
- 中文原生支持:对中文搜索结果(百度学术、知网、知乎)有专门处理
对中文 AI 生态的意义
过去一年,「深度研究」产品被 OpenAI / Google 主导。DuMate-DeepResearch 是第一个在 DRB 上跑到 55%+ 的开源项目,且对中文场景做了深度优化。
对中文 AI 公司(搜索、法律、医疗、咨询)的实操意义:
- 可以基于 DuMate 二次开发行业版
- 中文研究质量不再被「翻译损失」卡住
- 开源 + 国产 = 部署成本可控
论文开源地址:arXiv:2606.07299。预计 GitHub repo 在论文被引后会公开。