AI资讯新闻榜单内容搜索-模型排行

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型排行
我花了54个小时,做了一个可能更公平的AI大模型排行榜。

我花了54个小时,做了一个可能更公平的AI大模型排行榜。

我花了54个小时,做了一个可能更公平的AI大模型排行榜。

希望能做一个各个模型评分排行的汇总,方便实时了解和对比各种模型的性能。这个是一个非常有趣、且对我自己非常刚需的需求。因为现在的模型评测排行榜、评测集等等,实在是太多太多了,人人其实都可以做一份自己的评测集,然后来跑一份模型排行榜,有的测的全一些,有的就是个垂直场景的特定任务,这个量级真的特别大。

来自主题: AI资讯
9111 点击    2026-08-10 09:02
“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

近日,Meta 首席 AI 官、被称为公司“最高薪员工”的 Alexandr Wang,因一句简单却极具挑衅意味的话引起热议:“gemini who?(Gemini,谁啊?)”这场口水战的背后,其实是一场 AI 巨头之间的公开较量——Meta 最新模型 Muse Spark 1.1 在一份模型排行榜中超过了谷歌刚发布的 Gemini 3.6 Flash

来自主题: AI资讯
9453 点击    2026-07-25 11:30
全球最大AI榜单塌房!52%高分答案全是胡扯,硅谷大厂集体造假?

全球最大AI榜单塌房!52%高分答案全是胡扯,硅谷大厂集体造假?

全球最大AI榜单塌房!52%高分答案全是胡扯,硅谷大厂集体造假?

谁能想到,AI界最权威的大模型排行榜,竟然是个彻头彻尾的骗局?最近,2025年底的一篇名为《LMArena is a cancer on AI》的文章被翻了出来。登上了Hacker News的首页,引起轩然大波!

来自主题: AI资讯
9396 点击    2026-01-09 11:35
谁是AI之王?聊聊备受争议的AI评测与崛起的LMArena

谁是AI之王?聊聊备受争议的AI评测与崛起的LMArena

谁是AI之王?聊聊备受争议的AI评测与崛起的LMArena

当AI模型排行榜开始被各种刷分作弊之后,谁家大模型最牛这个问题就变得非常主观,直到一家线上排行榜诞生,它叫:LMArena。在文字、视觉、搜索、文生图、文生视频等不同的AI大模型细分领域,LMArena上每天都有上千场的实时对战,由普通用户来匿名投票选出哪一方的回答更好。

来自主题: AI资讯
10112 点击    2025-11-03 09:41
开源模型TOP5,被中国厂商包圆了

开源模型TOP5,被中国厂商包圆了

开源模型TOP5,被中国厂商包圆了

开源大模型,进入中国时间。 10月,公开数据显示,来自中国的开源大模型已经牢牢占据榜单前五。 阿里的Qwen系列和DeepSeek,更是从2024年下半年起,就在开源社区构建起越来越深远的影响力。

来自主题: AI资讯
8952 点击    2025-10-16 14:55
AI竞技场,归根到底只是一门生意

AI竞技场,归根到底只是一门生意

AI竞技场,归根到底只是一门生意

AI模型排行榜分两类:以高考式标准化测试衡量特定能力的客观基准测试(如AAII、MMLU-Pro),以及用户匿名盲测、根据偏好对答案投票排名的人类偏好竞技场(如LMArena)。两者各有优劣和局限性,且排行榜本质是门生意。用户应基于实际需求而非榜单名次选择模型,实用性至上。

来自主题: AI资讯
11482 点击    2025-08-07 10:45
今天的开源世界,属于中国!

今天的开源世界,属于中国!

今天的开源世界,属于中国!

家人们!燃起来了燃起来了! 今天,HuggingFace的开源大模型排行榜前10名中,竟有9个席位被中国模型占据!(深挖了一下,另外一位也是我们华人大神的项目)

来自主题: AI资讯
10654 点击    2025-07-31 10:53
GPT-4o「吉卜力风」一夜爆火,奥特曼连夜换头像!宫崎骏痛批AI侮辱生命

GPT-4o「吉卜力风」一夜爆火,奥特曼连夜换头像!宫崎骏痛批AI侮辱生命

GPT-4o「吉卜力风」一夜爆火,奥特曼连夜换头像!宫崎骏痛批AI侮辱生命

GPT-4o原生图像一出手,直接登顶流量王座!今天凌晨,OpenAI再放大招更新GPT-4o,冲进大模型排行榜第二碾压Grok 3、GPT-4.5。创意一键生成,Midjourney瞬间黯然失色,设计师开始颤抖吧。

来自主题: AI资讯
9955 点击    2025-03-28 17:22
11月中国AI大模型平台排行榜

11月中国AI大模型平台排行榜

11月中国AI大模型平台排行榜

有研究预计,如果 LLM 保持现在的发展势头,预计在 2028 年左右,已有的数据储量将被全部利用完。届时,基于大数据的大模型的发展将可能放缓甚至陷入停滞。

来自主题: AI资讯
9497 点击    2024-12-10 11:38