打通感知-理解-交互链路,全栈视频理解大模型VideoChat3开源了
打通感知-理解-交互链路,全栈视频理解大模型VideoChat3开源了视频是描述物理世界的重要数据形态,更是人类与物理世界交互的重要载体,视频理解大模型是让 AI 从数字世界走向物理世界最基础、最原生的组成部分。
搜索
视频是描述物理世界的重要数据形态,更是人类与物理世界交互的重要载体,视频理解大模型是让 AI 从数字世界走向物理世界最基础、最原生的组成部分。
苏度科技联合创始人、董事长苏昊是ImageNet的核心作者之一,师从李飞飞。这家公司走了一条与硅谷主流“纯大脑黑盒大模型”不太一样的路:软硬件协同设计,上下分层架构,上层负责任务规划与环境理解,下层负责具体物体操作;Sim-to-Real作为核心训练范式,让机器人在虚拟世界里经历几百万年的进化,再迁移到现实。
这家初创公司已与Georgia Power 签订合同,为位于Effingham County的这一数据中心综合体锁定了3.2GW的电力供应,这一规模可能使该设施跻身OpenAI迄今为止最大的数据中心之列。预计从2028年起将有数百兆瓦电力投入使用,其余开发工作将持续到2032年。1GW的电力足以在任意时刻为约75万户美国家庭供电。
商品交易恰好是一个通用的竞技场——精准地判断一件商品的真假、成色和估价,不是互联网上能搜到的信息,而是面向交付的生产过程中形成的专家数据。这个场景里生长出了一家提供垂直模型、数据和服务的公司——图灵深视。这家由清华大学孵化的公司,想实现一个简单的愿景:用 AI 守护商品交易信任。
“「出海四巨头」智谱、Kimi、千问......谁最受外企欢迎? ” 作者丨胡清文 编辑丨徐晓飞 去年这个时候,硅谷讨论的还是中国模型能不能打。但在今年,这个问题已经被一组数据碾过。 OpenRout
7月20日,一则消息震动全球AI圈:中国AI公司zAI(智谱AI)建成一座供电规模达1吉瓦(1GW)的AI数据中心,已开始部分运营。更核心的信息是——这座超大规模算力中心,完全未使用任何Nvidia芯片。
模型决定起点,数据定义终局。
“芯片的定价权越强,模型和应用公司的成本刚性就越难消解。” 当下,仅豆包一家大模型的日均Token调用量就已突破180万亿;国家数据局的统计显示,全国日均调用量在今年3月已超过140万亿——无论从哪个口径衡量,这都是一条两年内从“近乎为零”飙涨超千倍的曲线。
Databricks 表示 正在进行由 Coatue Management 领投的新一轮融资,公司估值为 1880 亿美元,比去年 12 月上次融资后的估值增长 40%,也高于上个月 The Information 报道 公司曾在考虑的 1750 亿美元估值。
近日,一目科技宣布完成E轮超10亿元融资,投后估值突破100亿元,跻身具身智能百亿估值俱乐部。多家产业方、一线人民币基金及全球化美元机构联合押注。这笔钱将用于产线订单的规模化量产交付,以及材料、芯片、算法和数据等底层技术的持续迭代。