“榨”出硅的极限:怎么让GPU不“闲着”?
“榨”出硅的极限:怎么让GPU不“闲着”?这篇文章,我们邀请到了由SGLang孵化的RadixArk的联合创始人和核心成员,以及数据中心专家,一起聊聊AI Infra的四层架构、行业如何把“硅”的潜力榨到极限,以及背后的关键技术。
搜索
这篇文章,我们邀请到了由SGLang孵化的RadixArk的联合创始人和核心成员,以及数据中心专家,一起聊聊AI Infra的四层架构、行业如何把“硅”的潜力榨到极限,以及背后的关键技术。
一句话,一个周末,Claude直接把自家最前沿的模型跑在了一台全新的AMD MI355X机架上!
2026年7月,Spectro Cloud完成超过1亿美元D轮融资,估值跨过10亿美元。Goldman Sachs Alternatives继续领投,AMD、Ericsson、LG Technology Ventures和美国政府服务商Maximus一同入场。这家公司没有制造芯片,也不训练大模型。它处理的是一件更加琐碎、却让许多企业头疼的事:GPU买回来以后,怎样真正用起来。
刚刚,在年度AMD Advancing AI大会上,AMD董事会主席兼CEO苏姿丰博士连放大招,发布AMD最强AI芯片Instinct MI455X GPU、“最强智能体CPU”Venice、“最强机架级AI基础设施”Heilos,还有一款专为机器人设计的Ryzen芯片。
一段原本为英伟达 CUDA 设计的计算程序,几乎无需修改内核代码,就直接跑在了一台搭载 M3 Pro 的苹果设备上。
就在最近,英伟达亲自下场,发布了一篇名为《AI Model Co-Design: Hardware-Friendly LLM Design》的技术博客。整篇文章洋洋洒洒,其实就想点醒行业一件事:别光顾着堆算力了,来看看你们是怎么把顶级显卡逼成“磨洋工”的吧。
这几天,全网被WAIC“霸屏”,从具身智能到国产算力,这场一年一度的AI盛典,同样吸引了科技圈所有目光。
不久前,Kimi 官方宣布,将暂停新会员订阅。月之暗面表示,公司正在增加算力,并将在容量允许后分批重新开放订阅。不过,官方目前尚未公布具体扩容规模,也没有说明新增订阅何时恢复。
7月17日至20日,2026世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2026)在上海世博、张江、西岸“三地四馆”同步启幕。
沐曦也把今年的新东西几乎一次性搬到了现场。曦景S600超节点首次亮相,单机柜64张GPU、可扩展至万卡集群;AI4S方向的曦索X300系列科学智能GPU首次发布;Agent体验区排起长队,数字员工、AI文创工作站几乎没停过。