AI资讯新闻榜单内容搜索-AR

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AR
阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。今日放榜的权威三方榜单 Arena 中,阿里 Qwen 模型仅次于 Anthropic 的 Claude 系列,整体性能处于全球大模型第一梯队。。

来自主题: AI资讯
9208 点击    2026-08-03 12:28
只用一张卡,做出了声称是100M参数以内最好的小模型?

只用一张卡,做出了声称是100M参数以内最好的小模型?

只用一张卡,做出了声称是100M参数以内最好的小模型?

近日,独立开发者 Harshal Singh 公布了一个仅有 3500 万参数的基础语言模型 BarunLM,并声称:「我预训练了世界上参数量小于 100M 的最好模型」。

来自主题: AI资讯
8806 点击    2026-08-02 13:45
OpenAI新模型突破10项菲尔兹奖级难题/AI女团选秀9个出道成团/最强AI 画不好《蒙娜丽莎》|Hunt Good周报

OpenAI新模型突破10项菲尔兹奖级难题/AI女团选秀9个出道成团/最强AI 画不好《蒙娜丽莎》|Hunt Good周报

OpenAI新模型突破10项菲尔兹奖级难题/AI女团选秀9个出道成团/最强AI 画不好《蒙娜丽莎》|Hunt Good周报

GPT-5.6 Sol 推翻 100 多年前的麦克斯韦猜想,下一代模型突破 10 个!数学家菲利普·阿拉图恩、加文·鲍尔和马修·D·克瓦尔海姆于 2026 年 7 月 29 日在 arXiv 上发表论文,提到由 GPT-5.6 Sol 找到了一个反例,证明了 100 多年前的麦克斯韦猜想是假的。

来自主题: AI资讯
9760 点击    2026-08-02 12:03
本周AI项目推荐|Seltz,Octen,ego(lite)... Agent搜索的基础层

本周AI项目推荐|Seltz,Octen,ego(lite)... Agent搜索的基础层

本周AI项目推荐|Seltz,Octen,ego(lite)... Agent搜索的基础层

Seltz为Agent自建一套持续更新的Web索引,让它能够及时看见公开网络中正在发生什么;AnySearch聚合开放Web和20多个垂直数据源,让Agent知道面对不同问题应该去哪里查;Octen则重写索引、排序和服务层,让Agent可以同时展开几十甚至上百次查询,更快、更大规模地看见信息。

来自主题: AI资讯
9660 点击    2026-08-02 11:20
5万条网页众源轨迹,真能把机器人模型练强吗?AXIS基准给出答案

5万条网页众源轨迹,真能把机器人模型练强吗?AXIS基准给出答案

5万条网页众源轨迹,真能把机器人模型练强吗?AXIS基准给出答案

Axis Robotics 与佐治亚理工、加州大学伯克利分校、南洋理工等高校团队通过超过 5 万条人类演示和一组规模实验,给出了一个肯定但更复杂的答案:众源仿真数据可以有效,但模型能否从数据规模中持续获益,取决于任务覆盖、行为多样性、质量控制和数据增强,而不只是轨迹数量。

来自主题: AI资讯
8137 点击    2026-08-02 11:17
JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub 给出的答案,是把可编辑画布同时变成用户工作区、Agent 的外部记忆、行动空间和共享项目状态。Agent 不再只从聊天记录里猜测上下文,而是直接「看」到画布上的提示词、参考图、候选版本、生成结果、依赖关系、失败记录和用户反馈,再据此规划、调用工具、写回结果。

来自主题: AI资讯
8818 点击    2026-08-02 11:09
“榨”出硅的极限:怎么让GPU不“闲着”?

“榨”出硅的极限:怎么让GPU不“闲着”?

“榨”出硅的极限:怎么让GPU不“闲着”?

这篇文章,我们邀请到了由SGLang孵化的RadixArk的联合创始人和核心成员,以及数据中心专家,一起聊聊AI Infra的四层架构、行业如何把“硅”的潜力榨到极限,以及背后的关键技术。

来自主题: AI资讯
9104 点击    2026-08-01 17:39
突发,谷歌地球紧急撤回Nano Banana 2生图功能!

突发,谷歌地球紧急撤回Nano Banana 2生图功能!

突发,谷歌地球紧急撤回Nano Banana 2生图功能!

昨天,谷歌把最新图像生成模型Nano Banana 2正式塞进了谷歌地球网页版。谁能想到,一觉醒来,新功能被玩坏,谷歌紧急撤回了这一功能!结果效果太逼真,被专家强烈反对后,谷歌紧急撤回了新功能,「加强防护措施」后再次发布。

来自主题: AI资讯
9472 点击    2026-08-01 11:09
Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

最近有个挺有意思的对比实验,来自 Composio 团队。他们用同一个模型 Kimi K3,分别放进三个不同的 agent 框架(harness)里跑 ——Claude Code、Hermes 和 Kimi Code—— 一共测了 28 个完全相同的任务。

来自主题: AI资讯
10209 点击    2026-08-01 11:06