AI资讯新闻榜单内容搜索-Her

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Her
AI预测台风精度或大幅提升,谷歌天气预测模型登上Nature并开源

AI预测台风精度或大幅提升,谷歌天气预测模型登上Nature并开源

AI预测台风精度或大幅提升,谷歌天气预测模型登上Nature并开源

8 月 6 日,谷歌 DeepMind、Google Research 与美国国家飓风中心等机构的研究人员在 Nature 发表论文,公布面向热带气旋业务预报的 AI 模型 WeatherNext Cyclones。论文显示,该模型可针对全球热带气旋生成最长 15 天的天气和气旋情景,并预测路径、强度及风圈半径。

来自主题: AI资讯
8388 点击    2026-08-11 10:28
ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

本文主要介绍来自该团队的最新论文 Teaching Vision-Language-Action Models What to See and Where to Look,目前该论文已经被 ECCV 2026 正式接收,相关代码和模型已全部开源。

来自主题: AI技术研报
7920 点击    2026-08-11 10:22
第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 Sol

第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 Sol

第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 Sol

Kimi K3 发布十天后,AI 原生云服务商 Together AI 公布了一份独立评测报告。

来自主题: AI产品测评
9611 点击    2026-08-10 15:06
让生成式模型「画」出空间智能,而非强迫LLM输出「坐标」! 浙大提出Agentic空间认知评估框架

让生成式模型「画」出空间智能,而非强迫LLM输出「坐标」! 浙大提出Agentic空间认知评估框架

让生成式模型「画」出空间智能,而非强迫LLM输出「坐标」! 浙大提出Agentic空间认知评估框架

近日,浙江大学 OmniAI 团队在 《Show, Don’t Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text》 中提出 ProVisE,让图像生成模型直接在图中回答空间问题,并将视觉答案还原为原 benchmark 可以评分的结构化预测。

来自主题: AI技术研报
8360 点击    2026-08-08 13:34
斯坦福新开了一门课,专门讲 AI 怎么自我进化

斯坦福新开了一门课,专门讲 AI 怎么自我进化

斯坦福新开了一门课,专门讲 AI 怎么自我进化

斯坦福最近公开了一门课的录像,叫 CS329A,主题是 Self-Improving AI Agents(自我改进的 AI agent)。两位主讲教授,Aakanksha Chowdhery 和 Azalia Mirhoseini,都有极深的工业背景。Aakanksha 曾是 Google 540B 参数 PaLM 模型的技术负责人,也参与了 Gemini 的研发

来自主题: AI资讯
9109 点击    2026-08-04 10:29
阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。今日放榜的权威三方榜单 Arena 中,阿里 Qwen 模型仅次于 Anthropic 的 Claude 系列,整体性能处于全球大模型第一梯队。。

来自主题: AI资讯
9166 点击    2026-08-03 12:28
Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

最近有个挺有意思的对比实验,来自 Composio 团队。他们用同一个模型 Kimi K3,分别放进三个不同的 agent 框架(harness)里跑 ——Claude Code、Hermes 和 Kimi Code—— 一共测了 28 个完全相同的任务。

来自主题: AI资讯
10183 点击    2026-08-01 11:06
独家|牛津博士后林庆泓加入世界模型创企Video Rebirth,探索多模态智能体

独家|牛津博士后林庆泓加入世界模型创企Video Rebirth,探索多模态智能体

独家|牛津博士后林庆泓加入世界模型创企Video Rebirth,探索多模态智能体

Z Potentials 独家获悉,新加坡国立大学博士,牛津大学博士后研究员林庆泓(Kevin)近期以首席研究员(Principal Researcher)身份加入世界模型公司 Video Rebirth,负责多模态智能体与世界模型相关研究。

来自主题: AI资讯
10114 点击    2026-07-29 10:11
我把旧鼠标爆改成「AI 外挂」,比 Codex 键盘更适合我

我把旧鼠标爆改成「AI 外挂」,比 Codex 键盘更适合我

我把旧鼠标爆改成「AI 外挂」,比 Codex 键盘更适合我

这次就拿我自己天天在用的这只罗技 MX Anywhere 3S 为例,看看一只普通的办公鼠标,稍微改一改能不能变身「Vibe Mouse」。这只鼠标按键的默认功能与一般的办公鼠标别无二致:两侧的前进、后退键,对应的是浏览器和文件管理器里的翻页导航操作;滚轮按下就是普通的中键点击;而滚轮下方那颗功能键,默认用来切换有级/无级滚动模式。

来自主题: AI资讯
10132 点击    2026-07-28 12:28
当模型比你想的更聪明 聊聊 Boris Cherny 讲的 Claude Code 新玩法

当模型比你想的更聪明 聊聊 Boris Cherny 讲的 Claude Code 新玩法

当模型比你想的更聪明 聊聊 Boris Cherny 讲的 Claude Code 新玩法

你有没有想过,一个团队天天在做的事情,可能不是往产品里加东西,而是一直在删东西。这听起来有点反常识,做产品不都是越做越厚吗,怎么会越做越薄。

来自主题: AI资讯
7965 点击    2026-07-28 10:34