AITNT-让一部分人先用AI实现商业化

AI资讯-这里有最及时全面的人工智能资讯报道

AI技术研报-这里有最前沿的人工智能技术解读

AI监管政策-这里有最深刻的人工智能政策解读

AI产品测评-这里有最详细的人工智能工具测评解析

AI商业项目-这里有洞察力最强的AI项目的商业逻辑解析

AI排行榜-这里有最新的AI产品,大模型等人工智能行业的排行榜单

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
最新文章
从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用

从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用

从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用

近年来,大语言模型(LLMs)在长篇视觉叙事中展现出卓越潜力,生产方式正迅速从单一模型生成转向面向生产的智能体系统。但长视频剪辑仍然是一个极难控制的长期任务。模型有时会在缺乏素材依据的情况下强行生成,甚至在面对明显断档的转场或人物不一致时依然“盲目拼接”。

来自主题: AI技术研报
10255 点击    2026-06-21 10:41
谷歌CEO罕见承认落后了!Gemini 3.5 Pro被曝难产

谷歌CEO罕见承认落后了!Gemini 3.5 Pro被曝难产

谷歌CEO罕见承认落后了!Gemini 3.5 Pro被曝难产

据最新独家爆料,谷歌目前正在紧锣密鼓地对即将发布的重磅大语言模型Gemini 3.5 Pro进行高强度的激进迭代,在正式揭晓之前,内部预计还会测试更多的版本。

来自主题: AI资讯
9870 点击    2026-06-21 10:36
美国三家最强AI公司,怎么都去搞生命科学了?

美国三家最强AI公司,怎么都去搞生命科学了?

美国三家最强AI公司,怎么都去搞生命科学了?

2026 年 6 月 19 日,John Jumper 在 X 上宣布,自己将离开工作近九年的 Google DeepMind,在短暂休整后加入 Anthropic。随后,DeepMind CEO Demis Hassabis 也公开回复,感谢 Jumper 对 AlphaFold 和 AI for Science 的贡献。

来自主题: AI资讯
8247 点击    2026-06-21 10:35
AI接管数字世界!华为Claw-Anything:面向跨设备、跨时间、跨服务的Claw评测与数据引擎

AI接管数字世界!华为Claw-Anything:面向跨设备、跨时间、跨服务的Claw评测与数据引擎

AI接管数字世界!华为Claw-Anything:面向跨设备、跨时间、跨服务的Claw评测与数据引擎

我们相信,常驻型 (always-on) AI 助理的下一次飞跃,不在于把某一个模型单点调得更聪明,而在于扩展智能体的上下文 (Scaling Agent Context)—— 不断拓宽助理能够持续 "感知 — 推理 — 执行" 的范围,作为生活连接器连接用户的信息孤岛,直到它能接管用户的整个数字世界。

来自主题: AI技术研报
8526 点击    2026-06-21 10:34
谷歌:我手握最多诺奖得主,为啥就留不住他们?

谷歌:我手握最多诺奖得主,为啥就留不住他们?

谷歌:我手握最多诺奖得主,为啥就留不住他们?

最近,谷歌连失两员大将。短短三天内,先是 Transformer 论文共同作者 Noam Shazeer 离开谷歌加入 OpenAI;紧接着诺贝尔奖得主、AlphaFold 负责人 John Jumper 转投 Anthropic 麾下。

来自主题: AI资讯
9101 点击    2026-06-21 10:34
沿着何恺明团队「漂移模型」再走一步:奖励只需排名,单步文生图偏好优化提速3.51倍

沿着何恺明团队「漂移模型」再走一步:奖励只需排名,单步文生图偏好优化提速3.51倍

沿着何恺明团队「漂移模型」再走一步:奖励只需排名,单步文生图偏好优化提速3.51倍

来自西湖大学和香港中文大学(深圳)的团队沿着这一思路提出 Drifting Preference Optimization(DrPO),把漂移场用于单步文生图模型的偏好后训练。在 DrPO 中,奖励只负责对候选图像排序,不参与反向传播。具体而言,针对同一个文本提示词,当前模型生成一组候选图像。高分样本在特征空间中产生吸引,低分样本产生排斥,并结合参考模型约束给出模型的更新方向。

来自主题: AI技术研报
8102 点击    2026-06-21 10:33
CameraSquad:精准运镜,多视角一致——视频世界模型的空间智能新范式

CameraSquad:精准运镜,多视角一致——视频世界模型的空间智能新范式

CameraSquad:精准运镜,多视角一致——视频世界模型的空间智能新范式

如今,CameraSquad 的出现,让这种多视角一致的视频生成与 3D 世界状态构建成为现实。近日,中国科学院大学高林研究员团队联合卡迪夫大学、香港科技大学和快手可灵团队,提出了一种面向多轨迹并行生成的相机可控视频生成方法 CameraSquad [1],相关论文已被 ACM SIGGRAPH 2026 录用。

来自主题: AI技术研报
8467 点击    2026-06-21 10:32
ICML 2026|从「鉴伪」到「修复」,AI图像取证进入闭环时代

ICML 2026|从「鉴伪」到「修复」,AI图像取证进入闭环时代

ICML 2026|从「鉴伪」到「修复」,AI图像取证进入闭环时代

对于 AI 生成图像中可能存在的不自然伪影,我们是否不仅能够将其定位和解释,还能进一步对其进行修复,使图像恢复为更加真实、自然的视觉外观?围绕这一问题,来自北京大学等机构的研究者提出了 GenShield:一个统一的自回归框架,将 AI 生成图像检测 与 图像伪影修复 结合到同一个闭环中,实现从 “诊断” 到 “修复” 的一体化建模。

来自主题: AI技术研报
8280 点击    2026-06-21 10:31
GRPO过时了吗?

GRPO过时了吗?

GRPO过时了吗?

很多人认为这个数字不是随便挑的:美国政府向 Anthropic 下发出口管制指令、切断 Fable 5 与 Mythos 5 境外访问权限的那一刻,正是美国东部时间下午 5 点 21 分。「5 点 21」这个数字上的重复,被多家媒体解读为一次刻意设计的呼应。智谱选择在这个节点站出来,相当于当着全世界开发者的面说了一句话:你们担心的「模型随时可能被收回」,开源这边没有这个问题。

来自主题: AI资讯
9016 点击    2026-06-21 10:31
深入理解 Claude Code:从 CLAUDE.md 到 Hooks、Skills、Subagents..

深入理解 Claude Code:从 CLAUDE.md 到 Hooks、Skills、Subagents..

深入理解 Claude Code:从 CLAUDE.md 到 Hooks、Skills、Subagents..

在常规的对话外,Claude Code(也可以是 Codex)其实还提供了一些别样的控制(或者说:上下文注入)方法,比如:CLAUDE.md、Rules、Skills、Subagents、Hooks、Output Styles、以及 System Prompt Append

来自主题: AI技术研报
10736 点击    2026-06-21 00:03
撸猫撸出SOTA!3个00后2个月,造出史上最快流式音视频社交模型MaineCoon

撸猫撸出SOTA!3个00后2个月,造出史上最快流式音视频社交模型MaineCoon

撸猫撸出SOTA!3个00后2个月,造出史上最快流式音视频社交模型MaineCoon

一觉醒来,AI的新潮流变成了养猫???火速围观一下,刚刚全球流式音视频模型赛道闯进了一匹黑马,能力SOTA级,模型名字就叫缅因猫(MaineCoon)。养过缅因猫的朋友都知道,这个品种有个外号叫「猫狗」,意思是几乎你走到哪儿,它就跟到哪儿,相当粘人,互动感MAX。

来自主题: AI资讯
9282 点击    2026-06-20 20:20
Anthropic走出危机?这200家公司独享Mythos特权

Anthropic走出危机?这200家公司独享Mythos特权

Anthropic走出危机?这200家公司独享Mythos特权

美国政府出口管制令刚落,坊间以为Anthropic最强模型Mythos要彻底消失。结果彭博社一锤炸响:仍有200多家银行和科技巨头,通过「玻璃之翼计划」继续使用Mythos预览版挖网络漏洞!

来自主题: AI资讯
9979 点击    2026-06-20 20:20
哈?改个URL就行!alphaXiv甩出论文复现神器,单卡也能跑

哈?改个URL就行!alphaXiv甩出论文复现神器,单卡也能跑

哈?改个URL就行!alphaXiv甩出论文复现神器,单卡也能跑

机器之心编辑部 AI 读论文这件事,正在进入下一个阶段。 最近,alphaXiv 推出了一个面向 arXiv 论文的 autoresearch 功能。 它的使用方式非常直接:当用户看到一篇论文时,只需要把论文 URL 里的「arxiv」改成「autoarxiv」,系统就会:

来自主题: AI资讯
8949 点击    2026-06-20 20:19
Claude Code 破译了一门 3500 年前的语言

Claude Code 破译了一门 3500 年前的语言

Claude Code 破译了一门 3500 年前的语言

有人声称用 Claude Code 破译了 Linear A,一种来自克里特岛、已经沉默了 3500 年的古老文字。Claude Code 之父 Boris Cherny,也发文宣告了这个酷炫玩法:它是青铜时代米诺斯文明使用的书写系统,大约从公元前 1800 年开始出现,一直用到公元前 1450 年迈锡尼希腊人征服克里特岛为止。

来自主题: AI资讯
10712 点击    2026-06-20 14:55
Anthropic重磅产品线来了!Conway永久在线,智能体大军来袭

Anthropic重磅产品线来了!Conway永久在线,智能体大军来袭

Anthropic重磅产品线来了!Conway永久在线,智能体大军来袭

刚刚,Anthropic重磅产品曝光了:永久在线智能体Conway来袭,AI开始主动打工,告别对话框!同时,GPT-5.6也在悄悄内测了。巨头激战,谁将颠覆你的工作流?

来自主题: AI资讯
9891 点击    2026-06-20 14:15
给世界模型加上因果,她要让机器人真正理解“为什么”|对话Aether AI创始人黄碧薇

给世界模型加上因果,她要让机器人真正理解“为什么”|对话Aether AI创始人黄碧薇

给世界模型加上因果,她要让机器人真正理解“为什么”|对话Aether AI创始人黄碧薇

2011 年,Judea Pearl 凭借在因果推理领域的奠基性贡献获得图灵奖。他提出AI必须跨越三层:关联、干预、反事实。2018 年,他在面向大众的著作《The Book of Why》中将这一框架系统化为“因果之梯”。

来自主题: AI资讯
8889 点击    2026-06-20 14:14
具身智能公司Generalist AI完成新一轮4亿美元融资,估值为20亿美元

具身智能公司Generalist AI完成新一轮4亿美元融资,估值为20亿美元

具身智能公司Generalist AI完成新一轮4亿美元融资,估值为20亿美元

近日,皮特·弗洛伦斯创办的具身智能公司Generalist AI完成了一轮新融资,总规模为4亿美元(约合人民币27亿元),估值为20亿美元(约合人民币135.5亿元)。本轮投资方包括英伟达旗下的NVentures、知名天使投资人纳特·弗里德曼(Nat Friedman)和丹尼尔·格罗斯(Daniel Gross)共同管理的NFDG

来自主题: AI资讯
9516 点击    2026-06-20 14:14
剧本创作开源工具TOP10:视觉小说、交互叙事、AI集成,一篇说清楚怎么选

剧本创作开源工具TOP10:视觉小说、交互叙事、AI集成,一篇说清楚怎么选

剧本创作开源工具TOP10:视觉小说、交互叙事、AI集成,一篇说清楚怎么选

为什么推开源工具?在vibecoder到高级程序员都懂的原因,你能自己魔改成自家用的黑科技有什么不好?而且还不用订阅不花钱。为此,我们搞了这个游戏开发者的实用选型指南。每一个工具,都会告诉你:它适合做什么、不适合做什么、以及如何与AI工作流结合。

来自主题: AI资讯
9792 点击    2026-06-20 14:14
一个开源SDK融资800万美金,Waniwani让保险公司能直接在ChatGPT里把保单卖出去

一个开源SDK融资800万美金,Waniwani让保险公司能直接在ChatGPT里把保单卖出去

一个开源SDK融资800万美金,Waniwani让保险公司能直接在ChatGPT里把保单卖出去

Waniwani宣布完成了800万美元的种子轮融资,由Seedcamp领投,Redstone、Zone II Ventures、Plug & Play、OPRTRs Club、Kima Ventures以及一批知名天使投资人跟投。

来自主题: AI资讯
8649 点击    2026-06-20 14:13
近10亿元Pre-A轮!世界模型独角兽流形空间宣布完成新一轮数亿元融资

近10亿元Pre-A轮!世界模型独角兽流形空间宣布完成新一轮数亿元融资

近10亿元Pre-A轮!世界模型独角兽流形空间宣布完成新一轮数亿元融资

今天,流形空间宣布完成新一轮数亿元融资。本轮投资方包括中国国新旗下国新基金,淡马锡旗下毅峰资本,产业资本北汽产投、芯能创投等。流形空间成立于2025年5月,一年以来已经累计完成6轮融资,Pre-A轮累计近10亿元,

来自主题: AI资讯
10010 点击    2026-06-20 14:13
开源一个为演讲而生的PPT Skill,再不用跟观众大眼瞪小眼了

开源一个为演讲而生的PPT Skill,再不用跟观众大眼瞪小眼了

开源一个为演讲而生的PPT Skill,再不用跟观众大眼瞪小眼了

从v0.7开始,我先给 Humanize PPT 划了一条边界。把渲染PPT页面外包给下游的Skill。Humanize PPT负责把大纲,逐页意图,视频和图片素材的坑位和演讲稿,整理成结构化的 JSON 与 Markdown,再交给下游 Skill 原生渲染。

来自主题: AI资讯
9059 点击    2026-06-20 14:12
三个月,一场必然失败的Tokenmaxxing

三个月,一场必然失败的Tokenmaxxing

三个月,一场必然失败的Tokenmaxxing

早在3月20日,纽约时报的凯文·罗斯就发现了在硅谷开发者中,出现了一种叫做 Tokenmaxxing的现象。这个现象最早出现在OpenAI、Anthropic等前沿模型开发公司。OpenAI 的工程师一周用了 2100 亿个token,大概是 33 个维基百科的量;Claude Code 的工程师则一个月单人可以烧15万美元token。

来自主题: AI资讯
8815 点击    2026-06-20 14:12
面对 AI,人类手里还有「什么牌」?

面对 AI,人类手里还有「什么牌」?

面对 AI,人类手里还有「什么牌」?

过去两年,关于 AI 的讨论几乎都绕着同一个词打转——失业。哪些岗位会消失,多少程序员会被取代,下一个被端掉饭碗的白领是谁。这个叙事好懂,也足够让人焦虑,所有人都能对号入座。

来自主题: AI资讯
8601 点击    2026-06-20 14:11
央视查了一个成人漫画站,我看到的是 AI 把色情做成了流水线

央视查了一个成人漫画站,我看到的是 AI 把色情做成了流水线

央视查了一个成人漫画站,我看到的是 AI 把色情做成了流水线

在今天这个时间点,一个色情漫画网站的浏览量能到 1 亿次,背后大概率有 AI 的参与。于是我顺着央视记者查到的那个网站名字搜了一圈,果然,这类色情漫画网站里,很大一部分内容都是 AI 做出来的。

来自主题: AI资讯
9694 点击    2026-06-20 11:13
超越SONIC!人形机器人「小脑」的GPT时刻来了,还有史上最大动捕数据,整整20亿帧

超越SONIC!人形机器人「小脑」的GPT时刻来了,还有史上最大动捕数据,整整20亿帧

超越SONIC!人形机器人「小脑」的GPT时刻来了,还有史上最大动捕数据,整整20亿帧

银河通用团队用史上最大、整整 20 亿帧的动捕数据,训练出了全球首个人形机器人全身实时运控基座大模型,该模型零样本泛化全新动作,成功率从 MLP 架构的 76.89% 跃至 92.58%,推理延迟仅 0.39ms,效果超越英伟达 SONIC,甚至比目前业内主流 TWIST 系统速度提升至五倍。

来自主题: AI资讯
9813 点击    2026-06-20 10:31
小米开源Xiaomi Miloco 2.0,从此智能家居终于“智能”了!

小米开源Xiaomi Miloco 2.0,从此智能家居终于“智能”了!

小米开源Xiaomi Miloco 2.0,从此智能家居终于“智能”了!

小米正式发布并开源了Xiaomi Miloco 2.0,一套面向未来的全屋智能AI开源方案。直观来看,小米给Agent时代的智能家居装上了新的“AI大脑”,把超级AI管家带进了智能家居生态中。

来自主题: AI资讯
8492 点击    2026-06-20 10:28
我把昨晚的梦输入AI,它居然直接把我拉进去玩儿了一把?!

我把昨晚的梦输入AI,它居然直接把我拉进去玩儿了一把?!

我把昨晚的梦输入AI,它居然直接把我拉进去玩儿了一把?!

属实给我整精神了,AI啥时候会干的这事??不卖关子了,这是HappyOyster 1.0(快乐生蚝)实现的,阿里ATH推出的可实时构建和交互的开放式世界模型产品。看到世界模型四个字,可能有朋友好奇:这和我之前玩的Sora那些有啥区别?不都是AI生成画面嘛?

来自主题: AI资讯
9066 点击    2026-06-20 10:25
灵动岛,正在成为 AI 时代的新门面

灵动岛,正在成为 AI 时代的新门面

灵动岛,正在成为 AI 时代的新门面

真正把灵动岛推上风口的,是 6 月以来接连发生的几件事。6 月 8 日的 WWDC 2026,苹果发布了全新的 Siri AI。Federighi 在台上的原话是,苹果要「带来下一代 Apple Intelligence,并推出 Siri AI,一个明显更聪明、更博学、也更能干的 Siri」。

来自主题: AI资讯
8637 点击    2026-06-20 10:25
LLM终于学会推公式了!博世x清华推出FunctionEvolve:LLM-SRBench提升3.6倍,AI-Feynman满分

LLM终于学会推公式了!博世x清华推出FunctionEvolve:LLM-SRBench提升3.6倍,AI-Feynman满分

LLM终于学会推公式了!博世x清华推出FunctionEvolve:LLM-SRBench提升3.6倍,AI-Feynman满分

来自博世中央研究院与清华大学的研究人员提出 FunctionEvolve 框架,在两大基准测试上大幅刷新了这项任务的结果。在 LLM-SRBench 的 129 个合成科学方程任务上,FunctionEvolve 最终给出的公式在 55.8% 的任务上与真实公式等价(SA@1 = 72/129),是此前最好结果的 3.6 倍;

来自主题: AI技术研报
7929 点击    2026-06-20 10:24
碰撞暴降45.5%、200km 0接管!港大团队:自动驾驶真正的突破不在预训练,在后训练

碰撞暴降45.5%、200km 0接管!港大团队:自动驾驶真正的突破不在预训练,在后训练

碰撞暴降45.5%、200km 0接管!港大团队:自动驾驶真正的突破不在预训练,在后训练

香港大学李弘扬团队联合华为、上海创智学院及清华大学李升波教授团队,发表的最新论文World Engine: Towards the Era of Post-Training for Autonomous Driving给出了系统回答。

来自主题: AI技术研报
8582 点击    2026-06-20 10:24
AITNT官方交流群 AITNT APP上线