AI资讯新闻榜单内容搜索-训练数据

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 训练数据
何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

当下计算机视觉长期陷入“一任务一专用模型”内卷: 做深度估计要用DepthAnything,分割依赖SAM,人体姿态单独训练Sapiens,几何重建还得搭VGGT,各类网络骨干、解码器、损失函数完全割裂,研发与部署成本居高不下。

来自主题: AI技术研报
8579 点击    2026-08-07 09:10
打破机器人「数据焦虑」,穹彻智能想建一条「训练数据」生产线

打破机器人「数据焦虑」,穹彻智能想建一条「训练数据」生产线

打破机器人「数据焦虑」,穹彻智能想建一条「训练数据」生产线

对于具身智能行业而言,这不仅意味着一条数据处理产线效率的提升,更体现出机器人数据正在从「人工加工」走向「工业化生产」。

来自主题: AI资讯
6016 点击    2026-08-07 09:08
无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

在模型层之外,2026 年上半年在硅谷增长最快的赛道之一是数据:Mercor 的 run rate 从去年下半年的 5 亿美元涨到今年年中的 20 亿美元;Handshake 转型 human data 后,run rate 在年初三个月内从 5.5 亿美元冲到 10 亿美元;RL 环境公司 Fleet 则在半年内从百万美元级别做到 6000 万美元 run rate,

来自主题: AI资讯
8937 点击    2026-08-06 22:31
北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

多模态基础模型可以通过互联网规模的图像与语言学习「看」和「说」,但具身智能没有同样的捷径。机器人必须进一步理解物理状态与动力学,判断动作如何改变环境,并在真实世界中执行连续行为;这要求训练数据同时连接观察、状态、动作与物理后果。

来自主题: AI技术研报
6337 点击    2026-08-05 10:30
80亿参数记性不如U盘:他算出了大模型记忆天花板

80亿参数记性不如U盘:他算出了大模型记忆天花板

80亿参数记性不如U盘:他算出了大模型记忆天花板

一个80亿参数的大模型,一口气吞下15万亿token的训练数据,堆到硬盘上差不多7TB。可它真正「背」得下来的,少得可怜:每个参数只装得下3.6 bit。一个英文字母8 bit,连半个都填不满。

来自主题: AI技术研报
9167 点击    2026-08-02 22:14
5050亿参数!余承东开源盘古新模型openPangu-2.0-Pro,距离“世界第一”还有差距

5050亿参数!余承东开源盘古新模型openPangu-2.0-Pro,距离“世界第一”还有差距

5050亿参数!余承东开源盘古新模型openPangu-2.0-Pro,距离“世界第一”还有差距

今日,华为开源基于昇腾NPU训练的盘古MoE模型openPangu-2.0-Pro。该模型是openPangu-2.0系列的最新开源模型,总参数规模5050亿,激活参数规模180亿,支持512K上下文长度,训练数据总量约34T tokens。另一轻量化模型openPangu-2.0-Flash已于6月12日开源,参数92亿,其中6亿为激活参数。

来自主题: AI资讯
9604 点击    2026-07-31 21:54
抢完互联网数据,AI公司开始抢绝版纸质书

抢完互联网数据,AI公司开始抢绝版纸质书

抢完互联网数据,AI公司开始抢绝版纸质书

2026 年 4 月起,一位专营稀有书和低流通量图书的美国书商遇到了怪事:他店里的生意向来不算火爆,一周卖出二十本已经算不错,但最近,订单突然像洪水一样涌来,每周能卖几百本。最费解的是,买家只列出一份用国际标准书号(ISBN)索引的书籍清单,却从不询问品相,也不砍价。

来自主题: AI资讯
9774 点击    2026-07-30 20:50
世界模型再迎新突破,兔展智能UniWorld-View登顶WorldScore榜单

世界模型再迎新突破,兔展智能UniWorld-View登顶WorldScore榜单

世界模型再迎新突破,兔展智能UniWorld-View登顶WorldScore榜单

最近,兔展智能联合北京大学、鹏城实验室研发的 UniWorld-View 登顶李飞飞团队 WorldScore 世界模型榜单(训练数据来自北大系初创企业元空智能),并完成国产昇腾算力适配与代码、权重开源。

来自主题: AI资讯
9480 点击    2026-07-28 00:07
真实工作流,正在成为下一代训练数据

真实工作流,正在成为下一代训练数据

真实工作流,正在成为下一代训练数据

数据市场的故事,正在进入新一轮周期。来自企业真实工作流的 Real-world Data,成为越来越多 AI Labs 争夺的新资源。比如 GitHub 就是典型的 Real-world Data,它几乎完整保留了一个问题从出现到解决的全过程。相比之下,今天绝大多数 Human Data 公司提供的,仍是人为构造的数据。

来自主题: AI技术研报
8928 点击    2026-07-24 11:00
Mecka AI:不造机器人,它怎么靠“人类动作数据”融到 6000 万美元

Mecka AI:不造机器人,它怎么靠“人类动作数据”融到 6000 万美元

Mecka AI:不造机器人,它怎么靠“人类动作数据”融到 6000 万美元

今天分享一家很新的公司,Mecka AI,Mecka AI 是一家给机器人公司提供训练数据的公司。更具体一点,Mecka AI 做的是“人类动作数据”。也就是说,Mecka 做的事情很像“机器人时代的 Scale AI”。

来自主题: AI资讯
9149 点击    2026-07-10 11:04