PrimeScientist:让自主研究智能体学会战略性分配研究努力 精读
UC San Diego 与 Johns Hopkins 团队提出 PrimeScientist:把「研究努力的战略分配」首次形式化为共享推理预算下的序贯决策问题——可执行计划树保留竞争方案,自适应 MCTS 用剩余预算比调节探索-开采平衡。在 FIRE-Bench 上平均奖励比 AutoResearch 高 10.3%,尝试次数少 50.6%(24 任务中 23 次更少),消融证明预算自适应策略优于 UCT、Greedy 与固定指数。这为算力爆炸时代的自主科学研究确立了「省着花」这一被忽视的元能力。