全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」
全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」在“灵晟”国产超算登顶最新一期全球超级计算机TOP500榜单后,清程极智与“灵晟”联合完成纯CPU MoE模型分布式推理方案:16节点即可流畅运行DeepSeek-V3/R1-671B模型,在batch_size=2048时,输出吞吐量与80张主流GPU集群相当。
搜索
在“灵晟”国产超算登顶最新一期全球超级计算机TOP500榜单后,清程极智与“灵晟”联合完成纯CPU MoE模型分布式推理方案:16节点即可流畅运行DeepSeek-V3/R1-671B模型,在batch_size=2048时,输出吞吐量与80张主流GPU集群相当。
近日,浙江大学 OmniAI 团队在 《Show, Don’t Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text》 中提出 ProVisE,让图像生成模型直接在图中回答空间问题,并将视觉答案还原为原 benchmark 可以评分的结构化预测。
这个框架名叫 Prime Agent,由 Prime Intellect 发布。官方对它的定义是:一个面向编程、研究和长时间自主任务的「自我改进 RLM harness」。RLM 是 MIT 博士生 Alex Zhang 等人去年 10 月发布的一项工作(参见《递归语言模型登场!MIT华人新作爆火,扩展模型上下文便宜又简单》)
近日,由华为2012实验室、华为云、终端、计算等团队联合构建的openJiuwen开源AI Agent平台发布了企业级分布式蜂群架构,把JiuwenSwarm蜂群能力,扩展到企业级分布式集群。
近日来自南京大学模式识别实验室(PRLab)的梁嘉骏、廖宇程,在司晨阳教授的指导下,联合新加坡南洋理工大学、英国帝国理工学院,提出连续扩散语言模型 AURORA-LM(Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling),对连续空间下的语言建模作出了更多的思考和发现。
就在刚刚,OpenAI紧急叫停Astra!OpenAI内部评估显示,Astra在智能体编码和网络性能上取得的巨大突破,或已达到网络安全的「关键」阈值!这意味着,Astra可能具备自主开发零日漏洞,甚至仅凭高级指令发动新型端到端网络攻击的恐怖能力。
近日,一部名为《被裁掉的女孩》的AI短剧全网播放量突破两亿,成功将AI女主角“方桃子”捧红。随着人气攀升,这位虚拟女主近期在其视频节目中植入美瞳广告,引发网友热议。
6月12日,AI系列视频《被裁掉的女孩》在抖音及抖音精选上线,11集,73分钟,2亿播放,均集点赞超30万。第二季8月1日上线,仅一张预告海报,评论区就涌进上千条催更。主角方桃子成了全网第一个被记住的虚拟角色。有人说“我在桃子身上看到了自己”,这是今年暑期第一个真正意义上的爆款视频。
据报道,DeepSeek已重启第二轮融资,正以5000亿元人民币(约 740 亿美元)的估值寻求筹集近80亿美元。几乎与此同时,突然流传出一份关于DeepSeek的融资材料,称华兴康平私募基金管理(福州)有限公司发起设立一只暂定规模3亿元人民币的专项基金,拟以710亿美元的估值投资DeepSeek。
最近,有人注意到,Anthropic 在招聘一个名为「内部风险调查员」的角色,该角色的要求是「具备人类和技术调查方面的专业知识,以支持和保护 Anthropic 的使命…… 威慑、识别、调查和缓解对 Anthropic 最关键资产的风险,包括人员、数据和基础设施……」