a16z|2026年08月06日 18:17
vLLM 在任何时刻都运行在 50 万块 GPU 上。大多数人可能从未听说过它。
Simon Mo,@inferact 的联合创始人兼 CEO,同时也是 vLLM 的主要维护者,与 a16z 的 Matt Bornstein 和 Elena Burger 坐下来聊了聊:如何真正将开源模型投入生产、开源模型的优势、Simon 在 Inferact 的使命等等。
00:00 开场
01:46 开源如何成为关键基础设施
08:55 零日模型发布及其背后的戏剧性
14:59 Kimi K3 实际能为你带来什么
18:56 为什么开源模型许可证正在发生变化
22:24 用制药业类比模型训练的资金问题
26:16 如果 GPU 价格下降 99%
29:08 为什么 vLLM、OpenRouter 和 Ollama 都在 ChatGPT 之前启动
35:42 基于开源项目建立公司
39:48 RoPE 的发明者移除了 RoPE
@simon_mo_ @BornsteinMatt @VirtualElena
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接