实时 AI 消息
Karpathy发布开源项目autoresearch:AI自主设计训练AI模型,上线一周获46.7k Star
AI领域知名研究者Andrej Karpathy正式开源autoresearch项目,让AI Agent自主完成模型架构设计、超参调优和实验运行的全流程。该项目上线一周即斩获46.7k GitHub Star,成为平台增长最快的项目之一。
Andrej Karpathy近日正式发布了开源项目autoresearch,引发了AI社区的广泛关注。这个项目的核心理念颇为激进:让AI自己当科学家,自主设计模型架构、修改优化器、运行实验、分析结果,并决定下一步的研究方向。
根据项目说明,autoresearch的工作流程如下:人类只需要编辑program.md指令文件,AI Agent便会读取指令、修改train.py代码,运行约5分钟的训练实验,检查验证集bpb指标,决定保留或丢弃结果,然后继续下一个实验。用户早上醒来时,系统可能已经运行了100多个实验并产出详细报告。
项目包含完整的GPT模型实现、Muon + AdamW优化器组合和训练循环代码。所有组件都可被修改——架构、超参数、批量大小、优化器类型等,Agent会根据实验结果自主迭代。Karpathy在Twitter上宣称:"研究现在完全属于AI Agent集群的领域,它们在天空中的计算集群上自主运行。"
受限于工具环境限制,我们未能直接访问GitHub仓库验证项目细节,但根据多个中文科技媒体的报道,该项目上线首周已获得约46.7k Star,被描述为GitHub历史上增长最快的项目之一。这一增长曲线反映了开发者社区对自主AI研究范式的高度关注。
autoresearch的潜在影响不容小觑。如果这套范式成立,AI研究将从依赖人类科学家的手工调参和实验设计,转向由AI Agent集群7×24小时自主运行的大规模并行探索。Karpathy本人也提出了一个递归增强设想:AI Agent产出的更好模型,反过来又用于训练下一代autoresearch Agent。
不过,社区中也存在审慎的声音。真正的前沿AI研究涉及大量工程创新、理论突破和对未知领域的直觉判断,目前的AI Agent是否具备这种能力还有待验证。autoresearch在简单任务上的自主优化效果可能突出,但在OpenAI、Anthropic等前沿实验室的竞争格局中究竟能发挥多大作用,仍需后续观察。
为什么重要
autoresearch将AI自主研究从概念推向了可实践的开源工具,可能加速AI研究范式从人工驱动向AI自主迭代转变。
附近消息
全部07/24 13:50
亚太唯一!阿里云跻身Gartner可观测魔力象限"挑战者"象限
Gartner发布2026年可观测魔力象限报告,阿里云首次跻身"挑战者"象限,成为亚太地区唯一入选的云厂商。这标志着阿里云在可观测性领域的国际竞争力获得权威认可。
07/24 13:41
元石科技发布"问小白5 Pro":一款面向长内容交付的AI Agent引擎
元石科技推出"问小白5 Pro",定位为新一代长内容生成引擎,主打"长、稳、可查"核心能力。该产品面向知识工作者和内容创作者,通过跨模态文件沙箱和结构化记忆管理,解决AI在长任务中前后逻辑漂移的关键痛点。
07/24 13:38
Anthropic 15亿美元版权和解案落地:哈利·波特出版商Bloomsbury将获约1900万美元
美国地区法院正式批准Anthropic与作者群体的15亿美元版权和解协议,哈利·波特出版商Bloomsbury作为受益方将获得约1900万美元(约1400万英镑)赔偿。该和解被称为"历史上最大规模的版权追偿",覆盖48.2万部作品。
07/24 12:45
金山办公发布灵犀专业版AI Agent,可处理10万字速记并直接交付工作成果
金山办公正式推出独立AI办公Agent"灵犀专业版",具备处理10万字长内容、自动整理知识库、生成可编辑PPT和Excel等完整交付能力。产品强调"懂你"定位,通过记忆用户工作历史和项目上下文来提供持续连贯的AI协作体验。