OpenAI、谷歌、Deepseek...各大AI前沿模型最近开始了一场"造芯大战",市场依旧缺卡缺算力,因而如何让手里的GPU发挥出更大价值,正在成为硅谷AI Infra(基础设施)背后千亿级的热门赛道。
当推理成为AI的主战场,GPU看似满载,却仍把大量时间耗在重复计算、缓存搬运和任务等待上。AI Infra深处,一场围绕调度与系统优化的效率革命已经开始。
为什么最昂贵的GPU仍会“又忙又闲”?AI Infra还能榨出多少藏在“硅”里的性能?当算力增长不再只靠堆卡,AI竞争的尺度会被怎样改写?这期视频,我们与推理引擎开源社区SGLang孵化出的RadixArk团队一起,深入探讨这场算力效率变革。
采访嘉宾:
朱邦华,RadixArk联合创始人、英伟达前首席研究科学家
陈震林Richard,RadixArk Member of Technical Staff
Ethan Xu,前微软能源战略经理、突破能源科研总监







