❯ 字节跳动提出智能体新扩展律:真实环境里每三个月学习速度翻一倍
研究发现据南华早报报道,字节跳动研究团队提出一条新的扩展律:AI 智能体通过在真实环境中执行长周期任务,学习速度可以每三个月翻一倍。研究配套开源了基准套件 EdgeBench,含 134 个超长周期任务,覆盖软件工程、科学发现、形式化数学到专业知识工作。
方法与背景与预训练时代「喂更多数据和算力」的路径不同,EdgeBench 把智能体放进可执行、带多层反馈的真实任务环境,允许每个任务迭代 12 小时以上,追踪的是完整的进步轨迹而非最终分。团队在五个前沿模型上累计跑了约 3.8 万小时,发现聚合分数收敛出一条高度一致的 log-sigmoid 曲线,而非预训练里常见的幂律。这项工作的针对性很强:包括 OpenAI 联合创始人 Karpathy 在内的多位业内人物已警告,靠堆数据与算力的暴力预训练难以为继,而「智能体在真实交互中自我提升」正被押注为下一条增长曲线。
影响落点对做 agent 产品的团队,这条曲线若成立,「让智能体在真实业务里长期跑、持续反馈」本身就是一种可量化的训练投入,评估重心要从单次跑分挪到长周期轨迹。对整个行业,当预训练触到数据墙,一条「三个月翻倍」的经验律给焦虑中的 AI 繁荣提供了新的续命叙事——尽管它同样需要海量真实环境和时间去验证。字节把 EdgeBench 开源,也是想抢下这条新曲线的定义权。
signal: 预训练撞墙之际,字节把增长的希望从「更大的模型」挪到「更久的真实交互」——下一步要看这条 log-sigmoid 曲线能否在别家复现。