VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块
VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块视觉问答模型的准确率不断提高,但高分未必来自视觉理解 —— 当基准图像与答案已进入训练语料,模型可能只是复现了记忆。浙江大学等团队提出 ReKey:保留原始真实场景,只更新决定答案的那一小块视觉线索,使每轮评测都面向未见过的内容。
搜索
视觉问答模型的准确率不断提高,但高分未必来自视觉理解 —— 当基准图像与答案已进入训练语料,模型可能只是复现了记忆。浙江大学等团队提出 ReKey:保留原始真实场景,只更新决定答案的那一小块视觉线索,使每轮评测都面向未见过的内容。
在具身感知赛道不断涌动的发展浪潮中,帕西尼再度以本轮融资将纪录推至新高。继上一轮超 10 亿元的破纪录融资之后,截至第三季度融资体量累计 35 亿元,叠加全球顶级产业资本与国家队的联袂入场,让其再度迎来高光突破。这种兼具超大体量与超高估值的罕见成长曲线,让帕西尼在全球具身赛道中,展现出了独树一帜的超断档领跑姿态。
刚刚,杭州大模型公司西湖心辰宣布,公司近日完成数亿元人民币B+轮融资。该公司创始人蓝振忠,是卡耐基梅隆大学AI博士、自然语言处理预训练语言模型“ALBERT”第一作者,曾任谷歌人工智能研究院科学家,研究成果已被应用于Google News、Google Assistant 等数亿级用户产品中。他于2020年6月受聘于西湖大学,创办深度学习实验室并担任博士生导师。
最近,有个很有意思的现象。
2026 年的 YC Startup School 上,Jeff Dean 的声音有些沙哑。
25分钟,500个钱包被洗劫一空!
OpenAI内部最新推理模型,一口气发布了十项惊人的数学进展。
WAIC之后,具身智能行业进入了一段微妙的冷静期。
近年来,视觉 — 语言 — 动作模型(Vision-Language-Action Model,VLA)正逐渐成为通用机器人控制的重要技术路线,但当这些模型真正进入高频闭环执行时,一个矛盾越来越突出:模型越来越大、语义能力越来越强,动作更新却未必足够快。
8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。今日放榜的权威三方榜单 Arena 中,阿里 Qwen 模型仅次于 Anthropic 的 Claude 系列,整体性能处于全球大模型第一梯队。。