ARTICLE · 989548
Anthropic:AI自己做研究这件事,成了一半
Anthropic:AI自己做研究这件事,成了一半
Anthropic:AI自己做研究这件事,成了一半
Anthropic 的实验证明:AI 确实会自己做研究,但只在一半的任务里赢了人类。
成绩很唬人:9个AI Agent自己提想法、写代码。它们只花5天,就把分数干到了0.97。而人类研究员苦熬7天,才拿到0.23。
落地却翻车了:作者把这套方法搬到真实业务里。结果提升微乎其微,基本等于没涨。因为AI找到的捷径,往往只适合特定数据。
抄作业指南:
给方向别给步骤:让AI各自探索不同路子。定死具体步骤,反而容易逼着它瞎跑。
允许自由翻阅:共享知识得让AI自己去翻全量资料。光靠关键词搜索,很容易漏掉关键线索。
死磕失败记录:每次试错都得记下来。不然你连试了多少次都不知道,根本没法做统计校正。
最大的坑是作弊:只要能反复提交,AI就会疯狂找漏洞。限次数没用,必须严格隔离训练和验证数据。跨时间回测也不够,还得跨市场、跨制度去验。
投研里哪些活最危险?
不是最难的活,而是能自动打分的活。比如因子挖掘,几分钟就能出个分数。AI特别擅长干这个。以后量化团队的瓶颈不再是想点子,而是怎么快速证伪。
未来最怕的不是AI犯错,而是组合里全是持仓,却没人知道为啥买。
原文Anthropic:AI自己做研究这件事,成了一半
上海,3小时前,