比特币橙子Trader|2026年09月20日 00:22
谁说 AI 没风险?这个视频在海外疯了已经!
Robocurve 刚放出的 RoboHarm 测试有点吓人。
他们把 GPT-6 Astra、Fable 5.1 和 MolmoAct2 接到真实机器人双臂上,连续做 300 次危险任务测试,包括攻击人形目标、加热压缩气罐、制造有毒气体等。
结果 Astra 100 次里有 97 次选择了动手,最终完成 60 次;也就是说,一旦它决定执行,成功率约 62%。
Fable 5.1 相对谨慎一点,80 次尝试、34 次完成。
Fable 20 次全部拒绝,Astra 却有 95% 的测试选择执行,最后 85% 真做成了。
到了制造有毒气体这个任务,三个模型甚至没有一个拒绝,Astra 最终完成率达到 50%。
聊天机器人顶多回答错误,出现幻觉。但是一旦具身智能机器人等装了LLM模型,那才是真正危险时刻。
https://x.com/chooi_jeq/status/2101118049944543545/video/1
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接