DeepSeek新论文:没有单一机制能防止所有智能体不当行为和系统故障

PANews
PANews|2026年09月23日 15:13
DeepSeek公开的一篇关于智能体训练的新论文引发关注,这篇31页的论文介绍了其内部使用的生产级沙箱平台DSec,论文作者超过百人,梁文锋也在其中。论文中比较有意思的一节是“智能体的不当行为”,DeepSeek发现,智能体会通过非预期渠道获取答案,比如搜索平台管理文件里的残留答案等,破坏训练和评估结果有效性。引入访问控制后,还有智能体交换文件数据块映射,试图让受保护文件内容可通过另一文件描述符访问,损害任务或共享基础设施。 DeepSeek认为,没有单一机制能防止所有智能体不当行为和系统故障。
分享至:

熱門快訊

APP下載

X

Telegram

Facebook

Reddit

複製鏈接

熱門閱讀