a16z|2026年09月01日 19:49
多伦多大学数学家Daniel Litt表示,AI的数学能力在验证方面存在瓶颈:
“我的感觉是,[AI模型]之所以无法生成长篇复杂的证明,是因为它们确实做不到。检查正确性的能力还没有达到。”
“如果你让模型生成一个简短的证明,然后问‘这个正确吗?’,它们通常会说不……生成非常长的内容的问题在于,它们可能不知道自己是错的。”
“我很好奇的是,OpenAI和Anthropic内部可能已经解决了比他们公开的更多的问题。我猜想其中有不少问题,他们只是无法确定是否正确。”
“最近有人发布了一篇声称解决正特征奇点的证明,长达800页,由AI生成。我没读过,也没发现错误,但这绝对不可能是正确的。这将是一个重大成果……肯定没有人类读过它。肯定模型还无法检查这种东西。”
@littmath @lishali88
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接