跳到正文
热点事件观察中

ScienceClaw:面向科学 Agent 持续自我演化的基准

1 篇报道1 个报道来源2 天前更新

先了解这件事

AI 综述

arXiv 报告(cs.AI)提出 ScienceClaw,一个基于固定参数程序的持续自我演化框架,把科学任务求解、验证和程序更新统一到一个系统中。框架通过多轮交互修复可执行工作流,将重执行验证中的失败—成功轨迹转化为关联的 Skill 和 Operator 候选更新,并只在源任务重放能复现修复、且独立科学任务也有改善时才保留更新。配套基准 ScienceClaw-Eval 覆盖 23 个学科,评估科学正确性、演化增益、保持、跨数据集迁移和演化成本五个方面。代码已公开;以上信息来自 arXiv 论文页面,材料未给出具体性能数字。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv · cs.AI
    ScienceClaw:跨自然与社会科学领域的 AI 科学 Agent 持续自我演化基准

    ScienceClaw 提出固定参数程序的持续自我演化框架,将科学任务求解、验证和程序更新统一起来,并在覆盖23个学科的 ScienceClaw-Eval 中评估科学正确性、演化增益、保持、跨数据集迁移和演化成本。框架通过多轮交互修复可执行工作流,将重执行验证的失败—成功轨迹转化为关联的 Skill 和 Operator 候选,并仅在源任务重放复现修复且独立科学任务改善时保留更新;代码已公开。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。