AI资讯新闻榜单内容搜索-生成模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 生成模型
疑似OpenAI新图像模型现身Arena,代号「蒙娜丽莎 mona-lisa-1」

疑似OpenAI新图像模型现身Arena,代号「蒙娜丽莎 mona-lisa-1」

疑似OpenAI新图像模型现身Arena,代号「蒙娜丽莎 mona-lisa-1」

这两天,Arena 平台上突然出现一款神秘的图像生成模型,代号「mona-lisa-1」。有人让该模型「生成一张你的创造者的图片」,模型点名 OpenAI 和奥特曼。且有网友用 OpenAI 验证工具检测生成图片后,确认图片中带有 OpenAI 的 SynthID 水印。

来自主题: AI资讯
9275 点击    2026-08-10 14:38
不靠 CFG、DMD、GAN、Drifting 和MeanFlow,如何训练一步生成模型?

不靠 CFG、DMD、GAN、Drifting 和MeanFlow,如何训练一步生成模型?

不靠 CFG、DMD、GAN、Drifting 和MeanFlow,如何训练一步生成模型?

只做一次生成器前向,就能得到一张图,这是一步生成追求的效率。但想把采样步数降到 1,难题其实在训练端:怎样用足够稳定、简单的监督信号,让生成分布靠近真实分布?

来自主题: AI技术研报
10086 点击    2026-08-10 09:51
让生成式模型「画」出空间智能,而非强迫LLM输出「坐标」! 浙大提出Agentic空间认知评估框架

让生成式模型「画」出空间智能,而非强迫LLM输出「坐标」! 浙大提出Agentic空间认知评估框架

让生成式模型「画」出空间智能,而非强迫LLM输出「坐标」! 浙大提出Agentic空间认知评估框架

近日,浙江大学 OmniAI 团队在 《Show, Don’t Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text》 中提出 ProVisE,让图像生成模型直接在图中回答空间问题,并将视觉答案还原为原 benchmark 可以评分的结构化预测。

来自主题: AI技术研报
8365 点击    2026-08-08 13:34
生成模型也能端到端训练了?核心竟是一个for循环

生成模型也能端到端训练了?核心竟是一个for循环

生成模型也能端到端训练了?核心竟是一个for循环

最近,一篇来自 UIUC 与哈佛大学的论文,试图把这块最后的拼图补上。作者给这个新范式起了个名字,叫 Explorative Modeling(探索式建模),模型简称 XM。它的想法简单到近乎朴素,却指向一个大胆的结论:生成模型除了参数和数据,其实还有第三根可以放大的轴。

来自主题: AI技术研报
7643 点击    2026-08-02 11:16
突发,谷歌地球紧急撤回Nano Banana 2生图功能!

突发,谷歌地球紧急撤回Nano Banana 2生图功能!

突发,谷歌地球紧急撤回Nano Banana 2生图功能!

昨天,谷歌把最新图像生成模型Nano Banana 2正式塞进了谷歌地球网页版。谁能想到,一觉醒来,新功能被玩坏,谷歌紧急撤回了这一功能!结果效果太逼真,被专家强烈反对后,谷歌紧急撤回了新功能,「加强防护措施」后再次发布。

来自主题: AI资讯
9456 点击    2026-08-01 11:09
MiniMax H3:打破任务和模态边界的开放模型

MiniMax H3:打破任务和模态边界的开放模型

MiniMax H3:打破任务和模态边界的开放模型

今天,我们正式发布 MiniMax H3。这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。

来自主题: AI资讯
6137 点击    2026-07-31 11:14
模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

近几年,多模态生成模型进步很快。一句指令就能生成图片、视频、音频、网页、UI、分镜,甚至整套演示文稿。只看成品,创作门槛似乎已经大幅降低。

来自主题: AI技术研报
6854 点击    2026-07-30 15:55
阿里通义发布第三代图像生成模型Qwen-Image-3.0,一手实测

阿里通义发布第三代图像生成模型Qwen-Image-3.0,一手实测

阿里通义发布第三代图像生成模型Qwen-Image-3.0,一手实测

今天,阿里通义团队发布了他们第三代图像生成模型:Qwen-Image-3.0 。官方博客用了一个字来概括这一代的核心进步,「实」。不是好看,不是炫技,是「实」。内容丰实、细节真实、知识厚实。

来自主题: AI资讯
9244 点击    2026-07-21 22:20