阿莫迪偷师姚顺雨,奥特曼偷师梁文锋
阿莫迪偷师姚顺雨,奥特曼偷师梁文锋Anthropic的Opus 5.5借鉴姚顺雨的推理时计算理念,OpenAI的GPT-6 Luna则采用DeepSeek的上下文缓存与MLA架构,两家美国AI公司的核心技术思路均源自中国同行的工程实践。
搜索
Anthropic的Opus 5.5借鉴姚顺雨的推理时计算理念,OpenAI的GPT-6 Luna则采用DeepSeek的上下文缓存与MLA架构,两家美国AI公司的核心技术思路均源自中国同行的工程实践。
过去三年,梁文锋极少以第一作者或通讯作者身份,出现在 V3.2、V4、V4.1-Flash 这些动辄上百人署名的旗舰模型整体报告中;却始终把名字签在 MLA 注意力、MoE 路由机制、mHC 拓扑流形、DSpark 推理算子、DSec 智能体沙盒这些最底层的原子技术论文上。
DeepSeek联合清华大学发布论文公开Agent训练沙盒基础设施DSec,梁文锋署名,论文第6节揭示DeepSeek已部分实现RSI(递归自我改进)闭环,Agent可在沙盒中自主构建训练环境,标志着Agent沙盒成为下一代云基础设施的新战场。
大模型训练拼的是算力,Agent训练拼的是环境。
DeepSeek正训练约2万亿参数的新模型,并计划将后续模型参数规模进一步推至8万亿,加入新一轮超大参数模型竞赛。
DeepSeek Flash系列自明日中午起降价,闲时缓存、输入和输出价格分别降至每百万Token 0.02元、1元和4元,新模型DeepSeek v4.1 Flash也已上线。
腾讯混元多模态团队又发生了一起人事变动。据媒体报道,曾负责xAI多模态理解负责人蔺旭东,已经离开xAI,加入腾讯混元,担任多模态内容生成算法负责人。
DeepSeek API要整体涨价了,预计涨幅较大。消息一出,梁文锋恢复不久的“梁圣”称号,又被互联网当场褫夺,贬回“梁子”。从“梁圣”“梁叔”到“梁子”“牢梁”,梁文锋的风评如同一只滑动变阻器,在不同刻度间反复游移,也让他成为中国AI圈最活跃的人形meme之一。
宇树上市在即,梁文锋大手一挥,拟认购超1.4亿元!8月6日,宇树科技公布首次公开发行股票并在科创板上市战略配售结果,共有9家投资者参与本次战略配售。其中,杭州深度求索人工智能基础技术研究有限公司(DeepSeek母公司)现身名单。
Coding之外, 关于原生多模态的争论从未停止。