“榨”出硅的极限:怎么让GPU不“闲着”?|与SGLang、RadixArk深聊AI Infra技术与千亿美元市场

关注

OpenAI、谷歌、Deepseek...各大AI前沿模型最近开始了一场"造芯大战",市场依旧缺卡缺算力,因而如何让手里的GPU发挥出更大价值,正在成为硅谷AI Infra(基础设施)背后千亿级的热门赛道。

当推理成为AI的主战场,GPU看似满载,却仍把大量时间耗在重复计算、缓存搬运和任务等待上。AI Infra深处,一场围绕调度与系统优化的效率革命已经开始。

为什么最昂贵的GPU仍会又忙又闲AI Infra还能榨出多少藏在里的性能?当算力增长不再只靠堆卡,AI竞争的尺度会被怎样改写?这期视频,我们与推理引擎开源社区SGLang孵化出的RadixArk团队一起,深入探讨这场算力效率变革。

采访嘉宾:

朱邦华,RadixArk联合创始人、英伟达前首席研究科学家

陈震林RichardRadixArk Member of Technical Staff

Ethan Xu,前微软能源战略经理、突破能源科研总监


反馈
联系我们
推荐订阅