a16z
a16z|2026年09月01日 19:49
多伦多大学数学家Daniel Litt表示,AI的数学能力在验证方面存在瓶颈: “我的感觉是,[AI模型]之所以无法生成长篇复杂的证明,是因为它们确实做不到。检查正确性的能力还没有达到。” “如果你让模型生成一个简短的证明,然后问‘这个正确吗?’,它们通常会说不……生成非常长的内容的问题在于,它们可能不知道自己是错的。” “我很好奇的是,OpenAI和Anthropic内部可能已经解决了比他们公开的更多的问题。我猜想其中有不少问题,他们只是无法确定是否正确。” “最近有人发布了一篇声称解决正特征奇点的证明,长达800页,由AI生成。我没读过,也没发现错误,但这绝对不可能是正确的。这将是一个重大成果……肯定没有人类读过它。肯定模型还无法检查这种东西。” @littmath @lishali88
+5
曾提及
分享至:

脉络

热门快讯

APP下载

X

Telegram

Facebook

Reddit

复制链接

热门阅读