AI资讯新闻榜单内容搜索-CV

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: CV
ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

本文主要介绍来自该团队的最新论文 Teaching Vision-Language-Action Models What to See and Where to Look,目前该论文已经被 ECCV 2026 正式接收,相关代码和模型已全部开源。

来自主题: AI技术研报
7926 点击    2026-08-11 10:22
ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

近日,清华大学与香港科技大学的研究团队提出 LiveEdit,一种面向通用文本指令的实时流式视频编辑框架。该方法以因果、分块的方式处理持续到来的视频,在 4 步 / 视频块的推理条件下实现 12.66 FPS 的流式编辑,并能保持被编辑区域的准确性以及未编辑区域的一致性。

来自主题: AI技术研报
7733 点击    2026-08-01 10:44
千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

以往的空间音频模型,要么受限于实验室的苛刻采集条件,要么被高昂的人工标注成本卡住脖子。而团队的核心洞察是:相机的自运动本身就是一种免费的监督信号。当相机转动时,声源在声场中的相对位置随之改变——这种变化无需人工标注,模型即可从中学习空间对应关系。这项工作入选CVPR 2025 Highlight,投稿论文前2%。

来自主题: AI技术研报
8267 点击    2026-07-26 11:25
清华弄了个镜像错觉艺术生成器,支持3D打印 | CVPR'26亮点

清华弄了个镜像错觉艺术生成器,支持3D打印 | CVPR'26亮点

清华弄了个镜像错觉艺术生成器,支持3D打印 | CVPR'26亮点

近日,来自清华大学等单位的研究团队提出了AutoMIA,一种自动生成镜像错觉艺术的 AI 设计方法,用户仅需任意指定两张图片,分别对应镜子前和镜子中的图案,AutoMIA就可以自动完成3维艺术品的设计,并且支持直接3D打印出来制作艺术品。

来自主题: AI资讯
8498 点击    2026-07-24 15:54
ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

国防科技大学虚拟现实与视觉计算团队(SAW Lab)联合先进制导与控制技术国家级重点实验室等推出面向航拍几何 3D 视觉的统一大规模数据集与评测基准 「AirZoo」。

来自主题: AI技术研报
6396 点击    2026-07-23 15:36