AI资讯新闻榜单内容搜索-AMI

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AMI
北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

多模态基础模型可以通过互联网规模的图像与语言学习「看」和「说」,但具身智能没有同样的捷径。机器人必须进一步理解物理状态与动力学,判断动作如何改变环境,并在真实世界中执行连续行为;这要求训练数据同时连接观察、状态、动作与物理后果。

来自主题: AI技术研报
6334 点击    2026-08-05 10:30
首发 | 菜鸟CTO李强创业做Physical AI平台,获云启、商汤超亿元种子轮融资

首发 | 菜鸟CTO李强创业做Physical AI平台,获云启、商汤超亿元种子轮融资

首发 | 菜鸟CTO李强创业做Physical AI平台,获云启、商汤超亿元种子轮融资

硬氪获悉,Physical AI平台公司「昆腾动力(Quantum Dynamics)」近日完成超亿元种子轮融资,本轮由云启资本、商汤国香资本联合投资。资金将主要用于Physical AI核心技术研发、人才梯队建设及全球化市场拓展,加速其面向物理世界的智能系统从底层模型到场景化落地的全链路构建。多维资本参与项目孵化与团队组建。

来自主题: AI资讯
9640 点击    2026-07-31 11:14
17岁高中生用AI看“眼底照片”筛查自闭症,准确率89%,还拿了110万奖金?

17岁高中生用AI看“眼底照片”筛查自闭症,准确率89%,还拿了110万奖金?

17岁高中生用AI看“眼底照片”筛查自闭症,准确率89%,还拿了110万奖金?

看一张眼底照片,就能判断一个孩子有没有自闭症或多动症风险——这个听起来像科幻的想法,2026 年被一名 17 岁的美国高中生做成了 AI 工具。这款叫 RetinaMind 的模型靠分析视网膜图像给出判断,准确率约 89%,在全美最古老的中学生科学竞赛"Regeneron 科学人才竞赛"上拿了第二名和 17.5 万美元奖金。

来自主题: AI资讯
9135 点击    2026-07-11 11:14
史上最高调的AI重写:Claude花11天搞定Bun,创始人花一个月才敢交底

史上最高调的AI重写:Claude花11天搞定Bun,创始人花一个月才敢交底

史上最高调的AI重写:Claude花11天搞定Bun,创始人花一个月才敢交底

这个 JavaScript 运行时原本拥有 535,496 行 Zig 代码,不包括注释;同时,约 20% 的代码由 C++ 编写,并嵌入了多个 C/C++ 库。此次借助 AI 重写为 Rust,整个过程涉及超过 100 万行代码变更、6778 次提交,并在 Claude Code 中运行了大约 50 个动态工作流(dynamic workflows)。

来自主题: AI资讯
8275 点击    2026-07-09 17:06
具身智能空间视觉死穴,终于被最新顶会彻底解决!

具身智能空间视觉死穴,终于被最新顶会彻底解决!

具身智能空间视觉死穴,终于被最新顶会彻底解决!

VLA 大模型看似强大,却被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。招商局先进技术研究院下属实验室提出新的移动数据范式,首次在真实机器人系统上证明:让相机动起来采集数据,就能以极低成本破解 VLA 的空间泛化瓶颈,且效果普适于多种主流架构。被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。

来自主题: AI技术研报
8827 点击    2026-07-08 09:46
世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍

世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍

世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍

以 LeWorldModel(LeWM)为例,它在规划时有一个重要瓶颈:每评估一条候选动作序列,模型都要一步步自回归 rollout。也就是说,LeWM 先预测下一步 latent,再把预测出的 latent 输入 dynamics model,继续预测下一步:

来自主题: AI技术研报
8248 点击    2026-07-07 14:57
谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束

谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束

谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束

近期, ECCV 2026 结果公布,Realsee 团队的成果 Argus: Metric Panoramic 3D Reconstruction for Indoor Scenes 成功入选。它面向室内全景图像,能够从稀疏、无序的全景照片中,直接预测相机位姿、度量深度和点云重建结果,可以为 3DGS 提供更稳定、更精准的几何约束。

来自主题: AI技术研报
8853 点击    2026-07-07 09:55
ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

来自南京大学 NLP 实验室的 ICML 2026 论文 Recognize Your Orchestrator: An Entropy Dynamics Perspective for LLM Multi-Agent Systems 指出:在当前主流的 Orchestrator-Executor 多智能体架构中,系统失败往往并不首先来自某个执行器不会干活,

来自主题: AI技术研报
8727 点击    2026-07-06 15:48
李飞飞LeCun疯狂加注!中国黑马零犀科技,已在因果AI暗战6年

李飞飞LeCun疯狂加注!中国黑马零犀科技,已在因果AI暗战6年

李飞飞LeCun疯狂加注!中国黑马零犀科技,已在因果AI暗战6年

从李飞飞World Labs的50亿估值,到LeCun出走创立AMI Labs的十亿种子轮,再到谷歌Genie 3让文本生成的世界第一次具备实时可交互、可导航的形态,世界模型正在成为AI下一阶段的核心战场。

来自主题: AI资讯
8881 点击    2026-07-06 12:25
刚刚,LeCun团队让世界模型学会持续学习!

刚刚,LeCun团队让世界模型学会持续学习!

刚刚,LeCun团队让世界模型学会持续学习!

刚刚,纽约大学联合LeCun初创AMI带来JEPA系列的最新成果——AdaJEPA。与过去在预训练结束后就冻结参数的世界模型不同,AdaJEPA能够在与环境交互中,基于测试时自适应(Test-Time Adaptation, TTA),实时调整世界模型的编码器和预测器参数,从而实现持续学习。

来自主题: AI技术研报
9847 点击    2026-07-03 16:12