千寻智能最强大脑亮相WAIC:攻克「金鱼记忆」,终结单一任务Demo内卷
千寻智能最强大脑亮相WAIC:攻克「金鱼记忆」,终结单一任务Demo内卷千寻智能的展台上,则来了两位画风完全不同的主角:一位是通体黑灰、看起来不苟言笑的 Moz1,埋头干活;另一位是首次公开亮相的 Moz2,奶杏色机身配上粉色小围脖「OOTD」,忙着向观众打招呼、举手比心,靠卖萌吸引了不少镜头。
搜索
千寻智能的展台上,则来了两位画风完全不同的主角:一位是通体黑灰、看起来不苟言笑的 Moz1,埋头干活;另一位是首次公开亮相的 Moz2,奶杏色机身配上粉色小围脖「OOTD」,忙着向观众打招呼、举手比心,靠卖萌吸引了不少镜头。
RoboScience机器科学直接把世博馆展台,变成了 Visics 的压力测试场。换本体、换物品、换任务,多轮挑战轮番上阵,专挑具身大模型最容易掉链子的地方下手。Visics 的泛化能力究竟行不行?现场观众可以直接点题,围观验货。
最近,来自 Google、哥本哈根大学、牛津大学等机构的研究者提出了 VGGRPO(Visual Geometry GRPO,收录于 ECCV 2026)。这项工作聚焦于一个核心问题:如何在不牺牲预训练模型泛化能力的前提下,高效地提升视频生成的几何一致性,并使其适用于动态场景。其核心思路是,在隐空间(latent space)中利用 4D 几何奖励,进行几何感知的视频后训练。
最近,一篇名为 FreeStyle: Free Control of Style-Content Dual-Reference Generation from Community LoRA Mining 的工作引起了不少关注。换句话说,FreeStyle 研究的是 style-content dual-reference generation,也就是「内容 - 风格双参考生成」。
最近不少人在给 Codex 做各种美化,但很多方案都有一个共同的问题:直接替换 app.asar、覆盖资源文件,或者整张截图覆盖整个界面。这样不仅升级容易失效,还可能导致程序异常。今天分享的是一套完整交付物——Codex Dream Skin。
彭博社的一则独家报道如同一盆冰水,浇灭了所有人的热情:Gemini 3.5 Pro发布延期了,而且不是延期几天,是数月的大延期!本该是载入史册的发布,被谷歌自己按下了暂停。
随后,SpaceXAI 兑现了承诺,在 GitHub 上正式开源了这套智能体编程框架。该公司在一篇 X 帖子中表示:“开源 Grok Build 可以让任何人都能参与构建可靠且强大的框架。”开源不到 20 个小时,Grok Build 已在 GitHub 上收获 1.21 万颗 Star。
世界模型圈一大难题是定义模糊,起码三四个流派各研究各的,都做了个产品就说自己是真正的世界模型,谁也没法说谁的不是。蚂蚁旗下的灵波科技疑似把这问题给解决了,因为哥们直接把几乎现有所有方向都做了一遍。
循环真正的门槛,并不在于让AI一直跑,而在于它能不能自己踩住刹车。
天哪,打工人也能有自己的私人助理了!