AI资讯新闻榜单内容搜索-Qwen3

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Qwen3
面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

埃默里大学提出的Decompose–Look–Reason(DLR)框架被EMNLP 2026接收,该方法通过分解问题、按premise提取视觉latent再推理,在Qwen3-VL-8B-Thinking上于V*、MathVista等基准取得显著提升。

来自主题: AI技术研报
7754 点击    2026-09-28 16:22
从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

从 Computer-Use 到 Robot-Use:一套接口让 VLM 直接「玩转」真实机器人

新加坡国立大学 Show Lab 发布的 Show-Harness 通过一套可被 VLM 理解的语义动作接口,使前沿视觉语言模型和轻量微调的 Qwen3.5-2B 能够跨模型、跨机器人本体直接操控真实机器人,并在跨任务、跨环境、跨本体实验中取得显著高于基线的成功率。

来自主题: AI技术研报
7248 点击    2026-09-28 09:50
答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

南洋理工大学S-Lab、A*STAR与UIUC联合提出的V-Rubrics方法将5万视觉样本拆分为35万条细粒度准则,从视觉忠实性、推理一致性和指令遵循三维度分别参与强化学习奖励分配,使基于Qwen3-VL-8B的模型在通用与知识评测中平均得分提升至68.04。

来自主题: AI技术研报
7292 点击    2026-09-28 09:48
我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

作者用 Qoder 搭配 Qwen3.8-Flash 模型调用开源工具 capcut-cli,在剪映 5.9 中自动完成口播视频的字幕识别、贴字和音效添加,生成可继续手动修改的分轨草稿。

来自主题: AI资讯
8706 点击    2026-09-27 23:11
实测Qwen3.8-Omni-Flash:全模态Agent有了“白菜价”

实测Qwen3.8-Omni-Flash:全模态Agent有了“白菜价”

实测Qwen3.8-Omni-Flash:全模态Agent有了“白菜价”

千问把全模态Agent的使用成本,直接砍掉了90%!

来自主题: AI产品测评
8191 点击    2026-09-22 11:17
独家|撬开Jev黑箱,对话全球首批复现者:9B小模型跑通79毫秒“快决策”

独家|撬开Jev黑箱,对话全球首批复现者:9B小模型跑通79毫秒“快决策”

独家|撬开Jev黑箱,对话全球首批复现者:9B小模型跑通79毫秒“快决策”

APUS(麒麟合盛)旗下AI实验室公开全球最早一批Jev独立开源复现成果fast-browser-use,基于Qwen3.5等开源模型在RTX PRO 6000上将单次决策压缩至79毫秒,并以9B小模型对标Jev性能。

来自主题: AI资讯
8968 点击    2026-09-21 22:08
Cell重磅:把血液、基因和蛋白数据交给AI,它开始学会判断衰老

Cell重磅:把血液、基因和蛋白数据交给AI,它开始学会判断衰老

Cell重磅:把血液、基因和蛋白数据交给AI,它开始学会判断衰老

Insilico Medicine、Liquid AI、巴克衰老研究所等机构在Cell发表论文,推出面向衰老研究的AI工具链LongevityBench、Longevity-LLMs和Longevity Claw,其中参数量仅9B的专用模型L-Qwen3.5-9B在综合排名中超越Gemini 3.1 Pro和Claude Opus 4.6。

来自主题: AI资讯
7934 点击    2026-09-20 11:08
全模态模型Qwen3.8-Omni-Flash发布

全模态模型Qwen3.8-Omni-Flash发布

全模态模型Qwen3.8-Omni-Flash发布

原生全模态模型Qwen3.8-Omni-Flash正式上线千问AI平台,支持文本、图像、音频、视频输入及1M长上下文,在30项评测中平均得分较上一代Qwen3.5-Omni-Plus提升超26%,在音视频Agent、剪辑、创作等场景效果显著,API每小时音频输入价格降幅超98%。

来自主题: AI资讯
9395 点击    2026-09-18 17:29
vLLM-Omni 上的 MiniMax H3:从系统级优化到基于 FastVideo FastH3 的实时服务

vLLM-Omni 上的 MiniMax H3:从系统级优化到基于 FastVideo FastH3 的实时服务

vLLM-Omni 上的 MiniMax H3:从系统级优化到基于 FastVideo FastH3 的实时服务

MiniMax H3 的服务是一个系统问题。一个请求要经过一个庞大的 Qwen3-VL 编码器、一个长序列的音视频 DiT、相互独立的视频与音频 VAE、设备与进程的边界,最后还要完成 H.264/AAC 的封装。只优化 DiT,其余环节的时延依然留在那里。

来自主题: AI技术研报
7476 点击    2026-09-14 09:47
杭州发千问办公token卡,要拿大结果

杭州发千问办公token卡,要拿大结果

杭州发千问办公token卡,要拿大结果

杭州自9月20日起向35家市级大学生创业园每人发放一张含1万积分的千问办公token卡,这是千问办公接入Qwen3.8-Max一个月后杭州首次将算力帮扶平铺到个人,标志着其AI产业思路从支持做模型的企业转变为支持用模型的人。

来自主题: AI资讯
9391 点击    2026-09-08 10:45