刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了
刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了全球文生图大模型王座,易主了。就在刚刚,LMArena竞技场发布了最新的文生图榜单,第一名来自中国,属于腾讯混元图像3.0!不仅超越了谷歌的Nano Banana,也超越了字节的Seedream和OpenAI的gpt-Image,在全球26个大模型中稳居第一。
搜索
全球文生图大模型王座,易主了。就在刚刚,LMArena竞技场发布了最新的文生图榜单,第一名来自中国,属于腾讯混元图像3.0!不仅超越了谷歌的Nano Banana,也超越了字节的Seedream和OpenAI的gpt-Image,在全球26个大模型中稳居第一。
今年滴滴悄悄上线了一个 AI 图寻产品「在哪儿问问」,目前产品体验仅有微信小程序端。不同于 GeoGuessr 的娱乐性,它更偏向实用的工具属性:拍一张,就能知道在哪儿;想去哪里,AI 马上帮你找。
十月AI战场,热闹得不像话。Sora 2刚刚亮相,Gemini 3.0就已蓄势待发。网友内测demo流出,前端和web编码强到离谱。坊间传闻,Gemini 3.0最晚下周上线。今天,谷歌内部研究人员在X上,频频发文暗示——BIG THINGS!
想象一下,医院和诊所里三分之一的员工不是在治病救人,而是在接电话、填表格、追保险理赔。这不是什么小问题,而是一个让整个医疗体系运转缓慢、成本高昂的巨大黑洞。
终于,Nano Banana正式开放API了! 现在大家不仅可以直接在Google AI Studio里基于Nano Banana,手动搓出属于自己的App,还可以通过Gemini API接入任意发挥了。
我惊! 图灵奖得主、AI三巨头之一的LeCun在Meta待得是如坐针毡。 Yann LeCun已经直接跟同事表示,自己可能会辞去FAIR首席科学家的职务。
想象一下,AI取代了你的工作,甚至连OpenAI的CEO也如此——奥特曼的答案竟是去当农场主!他分享了十年高压下的农场梦想,强调人类渴望创造价值永不止息。短期岗位流失不可避免,但长期来看,AI将催生更以人为本的新职业。
深夜十一点,手机屏幕的微光洒在林悦的脸上。 这一天,她已经陪伴了五个不同的求助者,从一段破碎的婚姻到一位年轻人面对失业的焦虑。作为一名心灵疗愈师,她习惯用温柔的语气安抚对方,用细致的分析梳理对方的情绪。可当最后一通咨询结束时,她却常常陷入一种无形的空洞:那些负面情绪全部向她涌来时,她也略显疲惫。
只让机器人或虚拟智能体「想象」,不让它们和物理世界交互,它们也能学到和世界交互的技能?谷歌的世界模型 Dreamer 4 为这一想法提供了新的支撑。为了在具身环境中解决复杂任务,智能体需要深入理解世界并选择成功的行动。世界模型通过学习从智能体(如机器人或电子游戏玩家)的视角预测潜在行动的未来结果,为实现这一目标提供了一种有前景的方法。
Sora2太卷了。居然能预测ChatGPT的输出、渲染HTML?!让它模拟“给ChatGPT发信息”,它不仅生成了画面,还来了一段有问有答的“交互”。先是编了一个问题:Write a playful haiku about a cat staring out the window.(写一首关于猫凝视窗外的俏皮俳句。)