世界模型有触觉了!50万小时视频,训出首个隐式触觉世界动作模型
世界模型有触觉了!50万小时视频,训出首个隐式触觉世界动作模型刚刚,BeingBeyond智在无界发布首个基于人类视频数据的隐式触觉世界动作模型—— Being-H0.8。
搜索
刚刚,BeingBeyond智在无界发布首个基于人类视频数据的隐式触觉世界动作模型—— Being-H0.8。
7月6日,比特币矿企TeraWulf与Anthropic签下一份为期20年的数据中心租约,合同总价值约190亿美元。两周后,另一家矿企Hut 8又公布了一份价值98亿美元的长期租约,它在得州建一座AI数据中心,把其中352MW的机房和电力容量租给一家未公开的大客户,租期15年,总租金约98亿美元。
最近,兔展智能联合北京大学、鹏城实验室研发的 UniWorld-View 登顶李飞飞团队 WorldScore 世界模型榜单(训练数据来自北大系初创企业元空智能),并完成国产昇腾算力适配与代码、权重开源。
数据从哪来?控制靠像素还是动作?
近日,蔡浩宇创立的AI公司Anuttacon发布公告,宣布旗下AI陪伴产品AnuNeko将于太平洋时间2026年7月29日23时59分正式停止运营。届时,应用及全部聊天记录都将无法访问,用户数据也会按照隐私政策永久删除。
近日,上海新智具身智能科技有限公司(NeoteAI)联合复旦大学可信具身智能研究院,正式发布了 N0 系列三份技术报告,把触觉从 “辅助模态” 跃升为 “核心基建”。 三份报告合起来看,恰好拼出一张蓝图 —— 一套触觉数据底座,搭配两条不同侧重的技术路线。
SFT是LLM从“通才”变成“专才”的关键步骤。业界默认做法是:准备标注数据(QA对、指令-回复对等)在基座模型上跑SFT训练。看loss曲线收敛了→认为训练完成。但问题在于:loss是全局平均,掩盖了样本间的差异。loss收敛只代表“大部分样本学会了”——那些始终学不会的样本被淹没了。
以往的空间音频模型,要么受限于实验室的苛刻采集条件,要么被高昂的人工标注成本卡住脖子。而团队的核心洞察是:相机的自运动本身就是一种免费的监督信号。当相机转动时,声源在声场中的相对位置随之改变——这种变化无需人工标注,模型即可从中学习空间对应关系。这项工作入选CVPR 2025 Highlight,投稿论文前2%。
多模型Agent系统显然是未来的趋势。cursor 的一篇很不错的文章。他们的最新研究表明,将前沿模型作为规划者和协调者,与一个更廉价的“主力”模型搭配,可以大幅降低项目中总token的成本,从而实现 15 倍的成本改进。
3D打印无疑是全球增长最受关注的赛道之一,但结构化、可编辑的物理3D数据却极度稀缺。就在这个行业真空里,一家年轻公司浮出水面——AI生成矢量3D模型的比特无限(BitInf)。