谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架
谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架推理创业公司Inferact用自研的megakernel内核结合DeepSeek的DSpark推测解码框架,让16块谷歌TPU v7运行Kimi K3达到每秒709个token,比同条件下16块英伟达GB200快57%。
搜索
推理创业公司Inferact用自研的megakernel内核结合DeepSeek的DSpark推测解码框架,让16块谷歌TPU v7运行Kimi K3达到每秒709个token,比同条件下16块英伟达GB200快57%。
本期节目对比了Groq、Cerebras与OpenAI在推理芯片上的三条技术路径,指出业界正围绕SRAM提升带宽性价比进行系统级异构收敛,并分享了英伟达首席科学家Bill Dally关于局部性与追求全局最优的芯片设计哲学。
2026 年 9 月,马斯克的 Neuralink 临床试验接受 27 例受试者,计划开启大规模量产。舆论再次沸腾,仿佛脑机接口的未来已到。
Memories.ai创始人沈俊潇在对话中阐述,记忆只是基础,公司真正聚焦于通过自建视频数据湖驱动物理AI实现"递归自我进化"(Physical RSI),其LVMM大型视觉记忆模型已与高通、英伟达达成合作,种子轮融资追加至1600万美元。
AI for Science的竞争,正在向科研闭环延伸。
就在今天,洛杉矶All-In峰会现场上演了名场面。
英伟达CEO黄仁勋在洛杉矶All-In Summit上接听特朗普现场来电,明确表示"绝不让AI减速",并就AI安全工程化、开源重塑中美AI竞争、英伟达向模型与基础设施两端延伸等议题展开近50分钟讨论,坚持放慢AI发展是错误策略。
最强的 AI 模型,正在遭遇一批最有钱的大客户设限。
英伟达正与Anthropic谈判,拟以锚定投资者身份投入最高100亿美元,参与其目标融资1000亿美元、估值近2万亿美元的史上最大IPO,预计于今年11月美国中期选举前完成。
AI云计算公司Nscale正与投资者商谈,计划在IPO前筹集最多35亿美元资金,包括向投资者出售最多15亿美元可转换票据及从英伟达获得约20亿美元融资,公司向投资者表示年营收预计可达约181亿美元,合同总价值约为1030亿美元。