autoresearch Vibe 项目
设定目标睡一觉,AI自动跑实验迭代找最优解
autoresearch 是将 Andrej Karpathy 的 pi-autoresearch 自主实验循环思路移植到 Claude Code 和 Codex 的开源项目。它让 AI Agent 自动循环执行:改代码 → 运行验证 → 评估结果 → 保留改进 → 丢弃失败,构建一个可自我演化的科研执行体系。
背景: 2026 年 3 月,Karpathy 发布了 autoresearch 脚本,核心理念是把一个真实的 LLM 训练环境交给 AI Agent,让它在你睡觉时自主做实验。autoresearch 将这套思路从 Python 脚本泛化为适用于 Claude Code 的 Skill 规范,让任何 AI 编程助手都能实现自动化实验迭代。
核心功能:
目标驱动的自动循环:给一个目标函数和量化指标,Agent 自动循环改代码验证 自动回滚机制:效果变差时自动回滚到上一版本,不丢失有效结果 14 个子命令:涵盖调优、Bug 修复、安全审计、发版等场景 9 个安全钩子:防止 Agent 误操作破坏代码库 内置实验日志:每次运行结果记录,方便早上查看总结
适用场景:
机器学习超参数调优:设定目标函数,让 Agent 自动搜索最优参数组合 代码性能优化:让 Agent 循环改写、性能测试、保留最快的版本 算法对比实验:自动跑多个算法变体,对比结果选出最优 睡前挂任务:设好目标去睡觉,起床看实验日志和更好的结果
工作原理:
用户定义目标函数(如验证准确率、运行速度) Agent 自动修改代码并运行验证 记录每次实验结果 效果提升则保留,效果下降则回滚 持续循环直到达到目标或达到迭代上限
项目地址:https://github.com/4BrvBcGeIX/autoresearch-claude-code
autoresearch 将让 AI 自己跑实验这件事变得普通开发者也能用,不需要昂贵的计算资源,只需要一个目标和 Claude Code/Codex,适合想用 AI 自动化提升研发效率的开发者。
评论与建议
登录 后参与评论或提建议