大模型灾难性遗忘新解法:秩1联想记忆实现无损持续学习 | ICML'26
大模型灾难性遗忘新解法:秩1联想记忆实现无损持续学习 | ICML'26想象一个刚上岗的实习生。教他做A任务,他学得很好;接着教他做B任务,他又学会了——但回过头再让他做A,他却忘得七七八八。
搜索
想象一个刚上岗的实习生。教他做A任务,他学得很好;接着教他做B任务,他又学会了——但回过头再让他做A,他却忘得七七八八。
近日,津渡生科(由4个牛津大学归国学霸创办)自主研发的生命科学垂类GeneLLM多组学大模型,接连登上国际顶级学术期刊——《Nature Communications》与《Advanced Science》。
「同志们朋友们,版本回调了!
AI行业正上演一场冰火两重天。一边是大模型公司将烧钱推向极致,万亿美元级别的开支砸向算力与研发;另一边,不练模型、不抢GPU,帮AI企业“管钱”的金融基础设施公司营收飙升。当所有人都在追问哪个模型会赢时,真正的赢家或许是这些提供AI基建的公司。
这几天社媒上一张AI漫画图非常火,图中人物虽是梁文锋,却进行了漫画化的处理,外观形象上尤其像超人等漫画人物,这被网友们评为,海外开发者眼中的梁文锋。
过去,LlamaFactory 让每个人都能微调大模型;现在,PenguinHarness 希望让每个人都能构建自进化 Agent。
刚刚,杭州大模型公司西湖心辰宣布,公司近日完成数亿元人民币B+轮融资。该公司创始人蓝振忠,是卡耐基梅隆大学AI博士、自然语言处理预训练语言模型“ALBERT”第一作者,曾任谷歌人工智能研究院科学家,研究成果已被应用于Google News、Google Assistant 等数亿级用户产品中。他于2020年6月受聘于西湖大学,创办深度学习实验室并担任博士生导师。
未来几年,医疗大模型的行业竞争将不再局限于基础模型技术的单点对抗,而是演变为模型能力、医疗数据、临床场景、医院生态四位一体的综合实力竞争。下文筛选海内外各10家代表性企业,集中展现了全球医疗大模型产业链核心力量与资本流向(本文内容仅作行业研究参考,不构成任何投资建议、投资引导及相关承诺)。
连续自主编程16天,24小时击败458支人类队伍。
今年 WAIC,最热闹的区域之一,是超维动力展台的一张乒乓球桌。