AI资讯新闻榜单内容搜索-RL

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: RL
比李飞飞的T-Rex更进一步:戴盟发布全球首个触觉锚定世界模型 Daimon-TWM

比李飞飞的T-Rex更进一步:戴盟发布全球首个触觉锚定世界模型 Daimon-TWM

比李飞飞的T-Rex更进一步:戴盟发布全球首个触觉锚定世界模型 Daimon-TWM

8 月 10 日,戴盟机器人正式发布全球首个触觉锚定世界模型 Daimon-TWM(Tactile-grounded World Model),以原生触觉贯穿物理认知、推演决策和瞬时反应全阶段。这个 “物理交互脑” 不仅能理解正在发生的物理接触,还能预测下一步交互会发生什么,并根据瞬息万变的反馈及时修正动作。

来自主题: AI资讯
7638 点击    2026-08-11 10:26
LSTM之父最新97页综述:Agent如何真正学会「自我进化」?

LSTM之父最新97页综述:Agent如何真正学会「自我进化」?

LSTM之父最新97页综述:Agent如何真正学会「自我进化」?

过去两年,self-reflection、self-correction、self-play、agentic RL、skill learning、test-time adaptation、open-ended evolution、self-evolving agent等概念不断涌现。

来自主题: AI技术研报
10213 点击    2026-08-10 09:51
深度|数字世界AI已经会自我改进了,物理世界呢?MirroS首发Physical RSI框架

深度|数字世界AI已经会自我改进了,物理世界呢?MirroS首发Physical RSI框架

深度|数字世界AI已经会自我改进了,物理世界呢?MirroS首发Physical RSI框架

MirroS给出了第一个完整回答。他们首创性地提出了Physical RSI——在公开文献中,第一次有人将递归自我改进的逻辑从数字环境系统性地延伸到物理现实,并交付了从概念定义、运行机制到研究路线图的完整框架。(原文见MirroS官方博客:Building Physical RSI Beyond the Known World,公众号「MirroS」亦有中文摘要。)

来自主题: AI资讯
9308 点击    2026-08-09 11:58
开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

这个框架名叫 Prime Agent,由 Prime Intellect 发布。官方对它的定义是:一个面向编程、研究和长时间自主任务的「自我改进 RLM harness」。RLM 是 MIT 博士生 Alex Zhang 等人去年 10 月发布的一项工作(参见《递归语言模型登场!MIT华人新作爆火,扩展模型上下文便宜又简单》)

来自主题: AI技术研报
9209 点击    2026-08-08 13:17
继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

近日来自南京大学模式识别实验室(PRLab)的梁嘉骏、廖宇程,在司晨阳教授的指导下,联合新加坡南洋理工大学、英国帝国理工学院,提出连续扩散语言模型 AURORA-LM(Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling),对连续空间下的语言建模作出了更多的思考和发现。

来自主题: AI技术研报
7841 点击    2026-08-08 13:15
无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

在模型层之外,2026 年上半年在硅谷增长最快的赛道之一是数据:Mercor 的 run rate 从去年下半年的 5 亿美元涨到今年年中的 20 亿美元;Handshake 转型 human data 后,run rate 在年初三个月内从 5.5 亿美元冲到 10 亿美元;RL 环境公司 Fleet 则在半年内从百万美元级别做到 6000 万美元 run rate,

来自主题: AI资讯
8930 点击    2026-08-06 22:31
李飞飞最新访谈:人也不全靠现实数据学习啊

李飞飞最新访谈:人也不全靠现实数据学习啊

李飞飞最新访谈:人也不全靠现实数据学习啊

时隔近两年,李飞飞终于再做客a16z,畅谈空间智能和World Labs在机器人赛道上的全盘布局。

来自主题: AI资讯
6370 点击    2026-08-06 15:42
别再吹AI生图了,不能图层编辑的AI都是“画饼”

别再吹AI生图了,不能图层编辑的AI都是“画饼”

别再吹AI生图了,不能图层编辑的AI都是“画饼”

面向设计生产场景,兔展智能研发了UniWorld-Design,进一步强化了视觉生成与编辑能力的结合,并基于此打造了产模一体战略的重要产品——RabbitVis。AI正在从通用能力竞争,进入场景能力竞争

来自主题: AI资讯
8304 点击    2026-08-06 10:47