全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」
全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」在“灵晟”国产超算登顶最新一期全球超级计算机TOP500榜单后,清程极智与“灵晟”联合完成纯CPU MoE模型分布式推理方案:16节点即可流畅运行DeepSeek-V3/R1-671B模型,在batch_size=2048时,输出吞吐量与80张主流GPU集群相当。
搜索
在“灵晟”国产超算登顶最新一期全球超级计算机TOP500榜单后,清程极智与“灵晟”联合完成纯CPU MoE模型分布式推理方案:16节点即可流畅运行DeepSeek-V3/R1-671B模型,在batch_size=2048时,输出吞吐量与80张主流GPU集群相当。
6月12日,AI系列视频《被裁掉的女孩》在抖音及抖音精选上线,11集,73分钟,2亿播放,均集点赞超30万。第二季8月1日上线,仅一张预告海报,评论区就涌进上千条催更。主角方桃子成了全网第一个被记住的虚拟角色。有人说“我在桃子身上看到了自己”,这是今年暑期第一个真正意义上的爆款视频。
据报道,DeepSeek已重启第二轮融资,正以5000亿元人民币(约 740 亿美元)的估值寻求筹集近80亿美元。几乎与此同时,突然流传出一份关于DeepSeek的融资材料,称华兴康平私募基金管理(福州)有限公司发起设立一只暂定规模3亿元人民币的专项基金,拟以710亿美元的估值投资DeepSeek。
8 月 7 日,阿里巴巴推出国内首个 AI 语音生产力平台 CosyVoice Studio,整合开放语音识别、语音合成、实时语音交互三类核心能力,覆盖「听、创、聊」全链路。
LightX2V团队面向Wan2.2-A14B推出LightWan2.2-A14B,以步数蒸馏、NVFP4量化感知训练和动态稀疏注意力压缩计算量,再用高效算子、细粒度卸载和多卡通信优化打通整条推理链路。
据Business Insider报道,当地时间8月5日,Anthropic称,公司正在组建内部芯片团队,为Claude设计定制AI芯片,并计划协同设计模型和硬件,以提升Claude大规模运行时的速度和效率。Anthropic发言人向Bussiness Insider证实了这一消息,这也是公司首次公开确认这一计划。
“当谷歌无法承载「疯狂假设」,这位 27 年的 Google 功臣,能否能用「不完美」的硬件终结 AI 的「暴力美学」?。 ”
根据公告,宇树科技网上、网下申购日均为8月10日,缴款截止日为8月12日。根据宇树科技公告,本次IPO采用战略配售、网下发行与网上发行相结合的方式进行,拟公开发行新股4044.64万股,拟发行数量占发行后总股本比例为10%。其中网上初始发行数量为647.10万股,网下初始发行数量为2588.62万股,初始战略配售数量为808.93万股。
DeepSeek刚刚做了一件很多人没想到的事:准备涨价。DeepSeek通过用户后台发布通知:靠低价打穿市场的DeepSeek,为什么突然开始涨价了?V4-Flash正式版7月31号发布,到今天满打满算也就一周时间,仅仅一周,因为极低的 API 成本和接近旗舰模型的能力,V4-Flash 的调用量直接飞升到全球第一,高峰期接口频繁超时。
7 月中旬的一天,清华科技园的一处办公区, 一台人形机器人站在屋子中央,身后没有风扇轰鸣的 GPU 机柜,不远处是两张落满公式的书写板。