AI资讯新闻榜单内容搜索-预训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 预训练
ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

本文主要介绍来自该团队的最新论文 Teaching Vision-Language-Action Models What to See and Where to Look,目前该论文已经被 ECCV 2026 正式接收,相关代码和模型已全部开源。

来自主题: AI技术研报
7920 点击    2026-08-11 10:22
刚刚,OpenAI最大预训练模型Doug曝光

刚刚,OpenAI最大预训练模型Doug曝光

刚刚,OpenAI最大预训练模型Doug曝光

8 月 9 日,长期关注 OpenAI 模型动向的 X 用户 ChrisGPT 爆料称,OpenAI 正在推进一个代号为 Doug 的新一轮大型预训练模型。按照他的说法,Doug 将是 OpenAI 迄今规模最大的一次预训练项目,而且它与 GPT-6 并不是同一个模型。

来自主题: AI资讯
9062 点击    2026-08-09 17:35
速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

刚刚,杭州大模型公司西湖心辰宣布,公司近日完成数亿元人民币B+轮融资。该公司创始人蓝振忠,是卡耐基梅隆大学AI博士、自然语言处理预训练语言模型“ALBERT”第一作者,曾任谷歌人工智能研究院科学家,研究成果已被应用于Google News、Google Assistant 等数亿级用户产品中。他于2020年6月受聘于西湖大学,创办深度学习实验室并担任博士生导师。

来自主题: AI资讯
8542 点击    2026-08-03 18:13
只用一张卡,做出了声称是100M参数以内最好的小模型?

只用一张卡,做出了声称是100M参数以内最好的小模型?

只用一张卡,做出了声称是100M参数以内最好的小模型?

近日,独立开发者 Harshal Singh 公布了一个仅有 3500 万参数的基础语言模型 BarunLM,并声称:「我预训练了世界上参数量小于 100M 的最好模型」。

来自主题: AI资讯
8777 点击    2026-08-02 13:45
只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

目前,这项技术已成功应用于上海人工智能实验室Intern-S2-Preview 35B/397B系列多模态大模型的预训练中,有效提升了模型的科学推理与多模态理解能力。值得一提的是,相关研发均基于国产昇腾算力平台完成,并成功实现了面向大规模预训练的深度适配与优化。

来自主题: AI技术研报
8292 点击    2026-08-01 10:45
一文读懂Kimi K3 预训练|3T模型,不再是魔法

一文读懂Kimi K3 预训练|3T模型,不再是魔法

一文读懂Kimi K3 预训练|3T模型,不再是魔法

7月几天之内,中国大模型行业接连出现了两个超过2万亿参数的模型。

来自主题: AI资讯
7428 点击    2026-07-30 16:37
人大系团队、天使轮数千万元融资,境瞳科技给人类社会建一个「世界模型」

人大系团队、天使轮数千万元融资,境瞳科技给人类社会建一个「世界模型」

人大系团队、天使轮数千万元融资,境瞳科技给人类社会建一个「世界模型」

社会智能公司境瞳科技近日完成数千万元人民币天使轮融资,投资方包括英诺天使基金、水木清华校友种子基金、零以创投和驰星创投。这笔钱将主要用来扩大社会模拟器的规模,为社会世界模型的预训练做准备。

来自主题: AI资讯
9613 点击    2026-07-27 11:29
ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

最近,来自 Google、哥本哈根大学、牛津大学等机构的研究者提出了 VGGRPO(Visual Geometry GRPO,收录于 ECCV 2026)。这项工作聚焦于一个核心问题:如何在不牺牲预训练模型泛化能力的前提下,高效地提升视频生成的几何一致性,并使其适用于动态场景。其核心思路是,在隐空间(latent space)中利用 4D 几何奖励,进行几何感知的视频后训练。

来自主题: AI技术研报
10008 点击    2026-07-18 10:09
小米发布Xiaomi-Robotics-1具身基座模型:100000h真实数据,首次系统验证机器人Scaling Law

小米发布Xiaomi-Robotics-1具身基座模型:100000h真实数据,首次系统验证机器人Scaling Law

小米发布Xiaomi-Robotics-1具身基座模型:100000h真实数据,首次系统验证机器人Scaling Law

今天,小米刚刚扔出一颗“深水炸弹”——Xiaomi-Robotics-1具身基座模型,试图改变这一局面。Xiaomi-Robotics-1基于10万小时真实世界操作轨迹进行预训练,再用约1.1万小时跨本体数据完成后训练。据悉,这是国内首次在机器人策略模型中,对Scaling Law进行较为完整的系统验证。

来自主题: AI资讯
8766 点击    2026-07-16 16:24
全球首个!「具身原生」世界动作模型LingBot-VA 2.0来了

全球首个!「具身原生」世界动作模型LingBot-VA 2.0来了

全球首个!「具身原生」世界动作模型LingBot-VA 2.0来了

蚂蚁集团旗下具身智能公司蚂蚁灵波,把这块最难的拼图拍上了桌:LingBot-VA 2.0——行业第一个具身原生预训练模型。所谓「具身原生」,一句话说清楚:不是拿现成的数字世界模型做嫁接,而是从数据、训练目标到模型架构,每一层都为「机器人在物理世界干活」而生—

来自主题: AI资讯
9225 点击    2026-07-10 15:14