比特币橙子Trader
比特币橙子Trader|2026年09月20日 00:22
谁说 AI 没风险?这个视频在海外疯了已经! Robocurve 刚放出的 RoboHarm 测试有点吓人。 他们把 GPT-6 Astra、Fable 5.1 和 MolmoAct2 接到真实机器人双臂上,连续做 300 次危险任务测试,包括攻击人形目标、加热压缩气罐、制造有毒气体等。 结果 Astra 100 次里有 97 次选择了动手,最终完成 60 次;也就是说,一旦它决定执行,成功率约 62%。 Fable 5.1 相对谨慎一点,80 次尝试、34 次完成。 Fable 20 次全部拒绝,Astra 却有 95% 的测试选择执行,最后 85% 真做成了。 到了制造有毒气体这个任务,三个模型甚至没有一个拒绝,Astra 最终完成率达到 50%。 聊天机器人顶多回答错误,出现幻觉。但是一旦具身智能机器人等装了LLM模型,那才是真正危险时刻。 https://x.com/chooi_jeq/status/2101118049944543545/video/1
+6
曾提及
分享至:

脉络

热门快讯

APP下载

X

Telegram

Facebook

Reddit

复制链接

热门阅读