现在很多人聊 Research Agent,最容易想象的画面是:
给它一堆论文,让它自己想一个新 idea。
但这篇论文提醒我一个很关键的问题:
idea 的质量,很多时候取决于它有没有被放回真实的文献脉络里。
论文提出了一个系统,叫 ResearchStudio-Idea。它的目标是把 ML 研究里常见的 idea 生成方式,整理成可以复用的 skill。
它主要包含三个部分:Paper-Search 负责找相关论文,Scoop-Check 负责检查 novelty claim 有没有撞车,IdeaSpark 负责真正生成研究想法。
最核心的是 IdeaSpark。
作者分析了 2021–2025 年 ICLR、ICML、NeurIPS 的 1,947 篇论文,从里面抽出 31 个 ideation sub-pattern,最后整理成 15 个可复用的 research ideation patterns。
这些 pattern 更像是研究经验的压缩:什么场景适合用,通常解决什么 bottleneck,和已有方法怎么拉开差异,过去哪些论文用过类似思路。
实验结果也比较直接。
在 100 个 ICLR 2026 Oral seeds 上,IdeaSpark 的 idea quality 得到 3.87/4,并且在 88 个 seed 上排名第一。相比之下,裸模型直接生成 idea 的效果明显弱很多。
论文里还有一个很有意思的现象:
GPT-5.5 bare 的 novelty 分数最高,但 quality 最低。
这说明一个问题:看起来「新」的 idea,不一定是好的 idea。很多时候只是因为它太泛、太空,所以不容易和已有工作直接撞上。
这篇最有意思的地方在于,它把 Research Agent 的重点从「多生成几个想法」,推进到了「把想法生成变成一套可复用的研究技能」。
未来真正有用的 Research Agent,可能会越来越依赖这种 skill library。它需要读更多论文,也需要把证据、瓶颈、已有方法和风险放在同一个框架里考虑。
AI 科研的下一步,可能会从「更会幻想」走向「更会沿着真实研究脉络提出问题」。
📎 arxiv:
显示更多