中国能否在国内硬件上大规模训练前沿模型?
中国已经能够在国内硬件上运行具有竞争力的人工智能模型,但仍然没有展示出使用完全国内堆栈进行前沿规模训练的案例。
前沿训练需要数千个加速器可靠地协同工作在大规模上。这样的协调依赖于芯片之间的快速连接、足够的内存和稳定的软件。系统中的任何弱点都可能中断训练过程。
中国在前沿训练中仍然依赖于英伟达的库存和批准进口,同时华为则在围绕昇腾开发国内基础设施。将这一基础设施扩展到规模还需要中芯国际提供更多的芯片产出,以及在国内内存和网络方面的持续进展。
2027–28年模型一代是首个可能在华为的国内基础设施上训练的版本。一个完全公开的训练记录将确认中国能够在没有外部硬件的情况下训练前沿模型。

免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。