AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
智能也有「元素周期表」!人类和细菌同一格,最强AI还低一位

智能也有「元素周期表」!人类和细菌同一格,最强AI还低一位

智能也有「元素周期表」!人类和细菌同一格,最强AI还低一位

中国科学院大学研究团队在《数据科学年鉴》发表论文《智能体能力周期表:从零智能到无限智能的243种构型》,将智能体抽象为控制、生成、记忆、输入、输出五种能力并各分三级,构建243种构型的分类表,指出人类与细菌同处122号格子、最强大模型智能体仅在控制维度比人类低一位即落在41号,并据此对经典力学、相对论与量子力学三大物理理论的观察者差异提出新解读。

来自主题: AI技术研报
8347 点击    2026-09-28 16:20
OpenAI横扫100多道世界难题,他却说:数学才刚开始

OpenAI横扫100多道世界难题,他却说:数学才刚开始

OpenAI横扫100多道世界难题,他却说:数学才刚开始

OpenAI一款8月28日开始训练的内部模型已攻克100多道世界级数学难题,多伦多大学数学家Daniel Litt撰文指出,AI虽将大幅提升数学产出效率,但人类对数学的理解仍不可替代,数学教育与评价体系需重新定义,真正应被保留的是人与人之间的讨论、追问与理解。

来自主题: AI资讯
6460 点击    2026-09-28 16:06
揭秘Mercor:一家能卡OpenAI和Anthropic脖子的“外包”公司

揭秘Mercor:一家能卡OpenAI和Anthropic脖子的“外包”公司

揭秘Mercor:一家能卡OpenAI和Anthropic脖子的“外包”公司

Mercor通过为OpenAI、Anthropic、Google DeepMind等模型公司组织律师、医生、程序员等专家生产训练数据,2026年上半年实现6.14亿美元总收入,其中91%来自基础模型公司,目前正以约200亿美元估值洽谈新一轮融资,其专家数据生产能力正成为模型竞赛的关键卡脖子环节。

来自主题: AI资讯
8803 点击    2026-09-28 11:42
五年前的一次选择,成了中国智能时代的王炸

五年前的一次选择,成了中国智能时代的王炸

五年前的一次选择,成了中国智能时代的王炸

五年前中科曙光立项曙光8000时提前押注"超智融合"路线,建成中国首个全国产十万卡AI超集群,将高精度科学计算与AI大模型训练集成于同一系统,近日随央视纪录片《超级工程》完整呈现其五年技术攻关与落地的全过程。

来自主题: AI资讯
7612 点击    2026-09-28 09:52
美女AI主播火了,2万人冲进直播间狂刷礼物!最强实时互动模型首秀

美女AI主播火了,2万人冲进直播间狂刷礼物!最强实时互动模型首秀

美女AI主播火了,2万人冲进直播间狂刷礼物!最强实时互动模型首秀

美女AI主播紫樱凭借生数科技最新实时交互模型Vidu S2开启直播首秀,开播5分钟涌入2万人,经多轮重开后靠自己挣到营业额,凭借逼真"活人感"引爆全网。

来自主题: AI资讯
7770 点击    2026-09-28 09:52
从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

新加坡国立大学 Show Lab 发布的 Show-Harness 通过一套可被 VLM 理解的语义动作接口,使前沿视觉语言模型和轻量微调的 Qwen3.5-2B 能够跨模型、跨机器人本体直接操控真实机器人,并在跨任务、跨环境、跨本体实验中取得显著高于基线的成功率。

来自主题: AI技术研报
7258 点击    2026-09-28 09:50
平均6天一个新旗舰!大模型更新快到人类跟不上了

平均6天一个新旗舰!大模型更新快到人类跟不上了

平均6天一个新旗舰!大模型更新快到人类跟不上了

OpenAI、Anthropic及国内十家主要大模型厂商平均每6天推出一款新旗舰模型,AI已大规模参与下一代模型研发,导致模型迭代速度首次超过人类适应速度,开发者调好的提示词和参数频繁面临报废。

来自主题: AI资讯
8579 点击    2026-09-28 09:50
答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

香港科技大学提出LexAgentHallu法律智能体幻觉评测基准,沿执行轨迹定位错误步骤,发现即使最终答案正确,仍有68%的轨迹存在法律内容幻觉,表现最好的配置也有89%的轨迹出现幻觉。

来自主题: AI技术研报
7407 点击    2026-09-28 09:49
Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

北京大学、清华大学与微软亚洲研究院在Nature Machine Intelligence发表研究,发现语言模型内部表征与人脑演绎推理脑区存在部分对齐,并可利用脑信号引导模型表征干预与参数微调,显著提升推理鲁棒性。

来自主题: AI技术研报
7802 点击    2026-09-28 09:49
模型越来越强,企业AI为什么还卡在「最后一公里」?

模型越来越强,企业AI为什么还卡在「最后一公里」?

模型越来越强,企业AI为什么还卡在「最后一公里」?

针对企业AI落地卡在「最后一公里」的难题,中国联通推出联通云犀工作流智能体,以通信场景为入口,将AI能力轻量化嵌入企业现有业务流程,已服务超6万家企业、800万用户。

来自主题: AI资讯
7149 点击    2026-09-28 09:48