Anthropic 揭示“AI 训练 AI”新方法:自动化系统查文献、提方案、30 分钟一轮迭代训练,成本低于人类研究员
Anthropic 公开一套“AI 训练 AI”的自动化研究方法:系统先查阅已有文献、自行提出训练方法,再按方案训练模型约 30 分钟,通过多轮尝试逐步提高测试成绩;有效方案留下、无效方案淘汰,使研究过程可快速扩大规模,比人类研究员成本更低、速度更快。
发生了什么
Anthropic 公布了一种让 AI 自动化改进 AI 训练流程的新方法。
工作方式
- 自动化系统先查阅已有研究文献,自行提出训练方法假设;
- 然后按方案训练模型约 30 分钟,跑评测验证效果;
- 通过多轮尝试逐步提高测试成绩:有效方案留存、无效方案淘汰,整个研究循环可以快速大规模并行。
意义
- 这套方法把“提出假设—实验—验证”的研究循环自动化,成本和速度都优于依赖人类研究员逐个尝试;
- 与 OpenAI 报告中披露的代理自主行为不同,Anthropic 强调该系统在受控研究流程内运行,是提升研发效率的工具。