Chinese AI agent outperforms Anthropic’s Claude Code in autonomous research
AI 摘要
一句话摘要: 浙江大学团队AI系统Qiushi Engine在自主科研排名中超越Anthropic的Claude Code,登顶国际榜首。 关键事实: Qiushi Engine在ResearchClawBench排行榜上位列第一,Open Science Desktop第二,Claude Code第三,该榜单测试AI独立完成科研并与参考论文对比的能力。 涉及主体: 浙江大学, Qiushi Engine, Anthropic, Claude Code, Open Science Desktop, ResearchClawBench 可能影响: 显示中国AI在自主科研领域的技术突破,可能加剧全球AI agent研发竞赛,推动科研自动化工具的商业化与开源生态发展。 是否值得继续跟踪: 是,因为该排名反映AI agent在科研场景的实用能力演进,后续若发布技术细节或开源,将影响行业基准与竞争格局。 噪音/炒作风险: 中,单一榜单排名易被过度解读,且缺乏对任务难度、泛化能力的透明评估,需结合多维度验证。