AI资讯新闻榜单内容搜索-语言模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 语言模型
Z Tech|独家专访:连续斩获NeurIPS、ICML顶级奖项,清华黄高副教授课题组三位核心作者

Z Tech|独家专访:连续斩获NeurIPS、ICML顶级奖项,清华黄高副教授课题组三位核心作者

Z Tech|独家专访:连续斩获NeurIPS、ICML顶级奖项,清华黄高副教授课题组三位核心作者

今年,由倪赞林担任第一作者,王慎执、乐洋共同参与的《The Flexibility Trap》获得 ICML 2026 Outstanding Paper Award。ICML 2026 投稿量达到创纪录的 24,000+ 篇,仅评出 2 篇 Outstanding Paper,该论文成为ICML历史上首篇完全由国内单位学者完成的获奖成果,为更好地理解和设计扩散语言模型做出了重要贡献。

来自主题: AI资讯
9184 点击    2026-08-09 11:18
开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

这个框架名叫 Prime Agent,由 Prime Intellect 发布。官方对它的定义是:一个面向编程、研究和长时间自主任务的「自我改进 RLM harness」。RLM 是 MIT 博士生 Alex Zhang 等人去年 10 月发布的一项工作(参见《递归语言模型登场!MIT华人新作爆火,扩展模型上下文便宜又简单》)

来自主题: AI技术研报
9214 点击    2026-08-08 13:17
继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

近日来自南京大学模式识别实验室(PRLab)的梁嘉骏、廖宇程,在司晨阳教授的指导下,联合新加坡南洋理工大学、英国帝国理工学院,提出连续扩散语言模型 AURORA-LM(Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling),对连续空间下的语言建模作出了更多的思考和发现。

来自主题: AI技术研报
7852 点击    2026-08-08 13:15
腾讯混元Hy ASR 3.0 preview发布:通用识别、方言覆盖、场景鲁棒性全面提升

腾讯混元Hy ASR 3.0 preview发布:通用识别、方言覆盖、场景鲁棒性全面提升

腾讯混元Hy ASR 3.0 preview发布:通用识别、方言覆盖、场景鲁棒性全面提升

8 月 4 日,腾讯混元正式发布新一代语音识别模型 Hy ASR 3.0 preview。基于最新一代大语言模型 Hy3 的语言理解能力,Hy ASR 3.0 preview 融合高精度语音识别与深度语义理解能力,在通用识别、上下文感知、多场景鲁棒性以及方言覆盖等核心维度实现全面提升,

来自主题: AI资讯
9586 点击    2026-08-05 15:14
速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

刚刚,杭州大模型公司西湖心辰宣布,公司近日完成数亿元人民币B+轮融资。该公司创始人蓝振忠,是卡耐基梅隆大学AI博士、自然语言处理预训练语言模型“ALBERT”第一作者,曾任谷歌人工智能研究院科学家,研究成果已被应用于Google News、Google Assistant 等数亿级用户产品中。他于2020年6月受聘于西湖大学,创办深度学习实验室并担任博士生导师。

来自主题: AI资讯
8542 点击    2026-08-03 18:13
80亿参数记性不如U盘:他算出了大模型记忆天花板

80亿参数记性不如U盘:他算出了大模型记忆天花板

80亿参数记性不如U盘:他算出了大模型记忆天花板

一个80亿参数的大模型,一口气吞下15万亿token的训练数据,堆到硬盘上差不多7TB。可它真正「背」得下来的,少得可怜:每个参数只装得下3.6 bit。一个英文字母8 bit,连半个都填不满。

来自主题: AI技术研报
9168 点击    2026-08-02 22:14
只用一张卡,做出了声称是100M参数以内最好的小模型?

只用一张卡,做出了声称是100M参数以内最好的小模型?

只用一张卡,做出了声称是100M参数以内最好的小模型?

近日,独立开发者 Harshal Singh 公布了一个仅有 3500 万参数的基础语言模型 BarunLM,并声称:「我预训练了世界上参数量小于 100M 的最好模型」。

来自主题: AI资讯
8778 点击    2026-08-02 13:45
一夜之间,Claude Code删掉了80%系统提示词

一夜之间,Claude Code删掉了80%系统提示词

一夜之间,Claude Code删掉了80%系统提示词

「我们删除了 80% 的 Claude Code 系统提示,这是我们从编写系统提示词、Skill 和 Claude.MD 中学到的。」本周五,Claude Opus 5 正式上线,Anthropic 技术团队成员 Thariq Shihipar 立即发帖,向我们介绍了新一代大语言模型之上,工程方面的趋势变化。

来自主题: AI资讯
9096 点击    2026-07-25 16:15
姚顺雨领军,腾讯合并大语言模型和多模态团队

姚顺雨领军,腾讯合并大语言模型和多模态团队

姚顺雨领军,腾讯合并大语言模型和多模态团队

近日,腾讯宣布混元多模态模型部门与大语言模型部门合并,成立基础模型部,统一由腾讯首席AI科学家姚顺雨管理,以进一步提升模型研发和协同效率,探索全模态模型的智能上限。

来自主题: AI资讯
9120 点击    2026-07-24 22:57
独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家获悉,近期,腾讯混元多模态理解负责人胡瀚提出了离职。此前,他曾担任微软亚洲研究院视觉计算组首席研究员。2025年初加入腾讯后,负责视觉大模型的研究。在后续的调整中,他加入大语言模型部旗下的“Frontier”前沿技术研究组,负责多模态理解的相关研究,汇报给姚顺雨。

来自主题: AI资讯
9744 点击    2026-07-23 16:56