NVIDIA 发布了一篇关于长时间运行代理的精彩论文。模型可以接受多达 128K 个上下文标记,但处理任务的时间越长,犯错误的可能性就越大。如果代理在处理长表格或账簿时中途迷失了方向,这篇论文会分析导致这一问题的原因。研究设置:Long-Transduction 要求模型在数千个输出中持续阅读、更新并输出状态相关的结果,并分别变化三个因素。研究结果:在七个预训练模型中,当上下文从 4K 增加到 128K 时,准确率下降了 62.8%;仅更改输入格式时下降了 36.5%;而每步处理的变化则导致准确率下降了 39.9%。
—— DAIR.AI (@dair_ai) X帖子|2026-10-02T15:45:04+00:00
原帖:https://x.com/dair_ai/status/2106047824093979033
DAIR.AI:NVIDIA 发布了一篇关于长时间运行代理的精彩论文。模型可…
NVIDIA 发布了一篇关于长时间运行代理的精彩论文。模型可以接受多达 128K 个上下文标记,但处理任务的时间越长,犯错误的可能性就越大。如果代理在处理长表格或账簿时中途迷失了方向,这篇论文会分析导致这一问题的原因。研究设置:Long-T
扫描二维码,在手机上阅读
