7 个判断,重新理解 AI 基础设施
7 个判断,重新理解 AI 基础设施近期,SemiAnalysis 创始人 Dylan Patel 先后做客红杉资本的《Training Data[1]》和 WisdomTree 的《The Next Big Thing[2]》。两期访谈从模型和芯片,一路延伸至内存、能源、数据中心与 AI 商业模式,并指向同一个变化:AI 竞赛的焦点,正从单纯比较模型能力,扩展到谁能以更低成本、更大规模,把模型能力稳定地交付出来。
搜索
近期,SemiAnalysis 创始人 Dylan Patel 先后做客红杉资本的《Training Data[1]》和 WisdomTree 的《The Next Big Thing[2]》。两期访谈从模型和芯片,一路延伸至内存、能源、数据中心与 AI 商业模式,并指向同一个变化:AI 竞赛的焦点,正从单纯比较模型能力,扩展到谁能以更低成本、更大规模,把模型能力稳定地交付出来。
2026 年 2 月,潘志刚(David Z. Pan)向 DeepTech 透露,他正在将一套 AI 电路推理方法扩展到版图设计,但“细节暂不便公开”。5 个月后,这位德州大学奥斯汀分校教授宣布担任 DeepWeave 联合创始人兼 CTO。
2026年7月,Spectro Cloud完成超过1亿美元D轮融资,估值跨过10亿美元。Goldman Sachs Alternatives继续领投,AMD、Ericsson、LG Technology Ventures和美国政府服务商Maximus一同入场。这家公司没有制造芯片,也不训练大模型。它处理的是一件更加琐碎、却让许多企业头疼的事:GPU买回来以后,怎样真正用起来。
刚刚,在年度AMD Advancing AI大会上,AMD董事会主席兼CEO苏姿丰博士连放大招,发布AMD最强AI芯片Instinct MI455X GPU、“最强智能体CPU”Venice、“最强机架级AI基础设施”Heilos,还有一款专为机器人设计的Ryzen芯片。
LPU创业公司元川微已完成Pre-A轮数亿元融资。本轮融资由IDG资本领投,孚腾资本、九坤创投、尚颀资本、顺禧基金、徐汇科创投联合投资。据了解,这也是元川微2026年以来完成的第四轮融资。
业界首个国产芯片上跑出的万亿参数模型LongCat-2.0于近日发布。
如果把AI芯片比作发动机,那AI软件栈就是「变速箱+传动系统+驾驶系统」。
7月20日,一则消息震动全球AI圈:中国AI公司zAI(智谱AI)建成一座供电规模达1吉瓦(1GW)的AI数据中心,已开始部分运营。更核心的信息是——这座超大规模算力中心,完全未使用任何Nvidia芯片。
刚刚,The Information报道,Google正在搞一颗代号「Frozen v2」的服务器芯片,打算把Gemini的部分架构直接固化进硬件里。
“芯片的定价权越强,模型和应用公司的成本刚性就越难消解。” 当下,仅豆包一家大模型的日均Token调用量就已突破180万亿;国家数据局的统计显示,全国日均调用量在今年3月已超过140万亿——无论从哪个口径衡量,这都是一条两年内从“近乎为零”飙涨超千倍的曲线。