中国科学院携手全球顶尖机构发布首个十亿参数级的手术视频基础模型SurgMotion!
中国科学院携手全球顶尖机构发布首个十亿参数级的手术视频基础模型SurgMotion!手术 AI 正在从 “单帧感知” 迈向 “全流程视频理解” 的全新时代!近日,由中国科学院香港创新研究院人工智能与机器人创新中心领衔,发布了全球首个十亿级参数、最大规模数据集练成的手术视频原生基础模型 ——SurgMotion!
搜索
手术 AI 正在从 “单帧感知” 迈向 “全流程视频理解” 的全新时代!近日,由中国科学院香港创新研究院人工智能与机器人创新中心领衔,发布了全球首个十亿级参数、最大规模数据集练成的手术视频原生基础模型 ——SurgMotion!
MrFlow(Multi-Resolution Flow Matching)就用这样的三阶段,在Qwen-Image等模型上把端到端生成时间从49.32s压到4.77s,实际加速10.35x。文章发布当日即登上Hugging Face Daily Papers;发布三天内,GitHub已收获200+stars;目前也已登上Hugging Face Trending Papers。
刚刚, GPT-5.6 解禁了。据 Axios 报道,美国商务部已经给 OpenAI 放行,批准GPT-5.6 可对外公开发布。放行前,商务部下属的AI标准与创新中心(CAISI)对模型进行了额外测试,OpenAI派技术专家常驻华盛顿配合答疑,最终通过审查。
Meta 旗下的超智能实验室 Meta Superintelligence Labs 推出了图像生成模型 Muse Image,并同步预览了 Muse Video。目前,Muse Image 已经接入 Meta AI 应用、网页端以及部分地区的社交平台,Muse Video 也即将向创作者开放。
近日,Boltz的联合创始人Gabriele Corso表示,公司和葛兰素史克(GSK)已经达成了一笔深度合作。据悉,GSK的药物发现团队将直接访问Boltz最新的专有基础模型、Boltz Lab 和API接口,以及Agent集成。
Exponential View 在 2026 年 6 月底发布《AI 经济现状报告》,通过一套去重复统计、自下而上覆盖千余家企业的财务测算模型,剥离行业虚高估值与宣传泡沫,还原海外生成式 AI 市场真实营收、资本开支、算力供需与产业链价值分配格局。
浪潮信息宣布,元脑SD200超节点AI服务器率先完成主流领先开源大模型Kimi K2.6、DeepSeek V4、GLM 5.2、MiniMax M3等的高性能优化,并在Kimi K2.6万亿参数大模型上实现Token生成时间快达4.77ms,为Agent场景应用的高效运行提供强大算力支撑。
王阳明心学,竟然在AI时代迎来了「最佳赏味期」?老哈,一个研究了十年「知行合一」的哲学教授,正在把这套500年前的心学,用到全球最前沿的AI对齐训练上。不是比喻。是字面意思。
2023 年大模型刚火的时候,浏览器被认为是 AI 时代最值得抢的入口,用AI颠覆Chrome是大家都能看到的百亿创业项目。实在是这个入口太大了。全球互联网用户已经是 60 亿量级,Chrome 一个产品就是三十亿级用户;Safari 靠 iPhone、iPad 和 Mac 占住十亿级设备入口,Edge 背后是 Windows 和微软账号体系。
VLA 大模型看似强大,却被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。招商局先进技术研究院下属实验室提出新的移动数据范式,首次在真实机器人系统上证明:让相机动起来采集数据,就能以极低成本破解 VLA 的空间泛化瓶颈,且效果普适于多种主流架构。被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。