AI资讯新闻榜单内容搜索-模型部署

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型部署
对话盛颖:xAI,Infra的浪漫,SGLang,开源,平权与“甄嬛传”

对话盛颖:xAI,Infra的浪漫,SGLang,开源,平权与“甄嬛传”

对话盛颖:xAI,Infra的浪漫,SGLang,开源,平权与“甄嬛传”

她是xAI前推理团队负责人。她研究并发起的开源推理引擎SGLang,已经成为众多大模型部署和推理的重要底层工具,也是目前AI infra领域最具影响力的开源推理框架之一。如今,她从SGLang开源生态中孵化出创业公司RadixArk,希望把只有少数科技巨头才能拥有的前沿AI基础设施,变成整个行业都可以使用的开放技术底座。

来自主题: AI资讯
9567 点击    2026-08-05 13:04
速递|苹果接触设备端AI初创PrismML,拟将270亿参数大模型部署至iPhone

速递|苹果接触设备端AI初创PrismML,拟将270亿参数大模型部署至iPhone

速递|苹果接触设备端AI初创PrismML,拟将270亿参数大模型部署至iPhone

这家名为 PrismML 的初创公司表示,已将 Qwen 3.6 缩减至可在 iPhone 17 Pro 上运行,该模型拥有 270 亿参数(参数大致类似于大脑中的突触,能够帮助决定模型可处理数据的复杂性)。相比之下,大多数在手机上运行的模型一次仅有几十亿个参数处于活动状态。

来自主题: AI资讯
8923 点击    2026-07-13 17:16
Reddit一张神图疯传!2年后,你的笔记本就能跑Fable 5

Reddit一张神图疯传!2年后,你的笔记本就能跑Fable 5

Reddit一张神图疯传!2年后,你的笔记本就能跑Fable 5

两年后,Fable 5 级 AI,可能就躺在你的笔记本里。就在昨天,全球最大的本地大模型社区r/LocalLLaMA,一张图刷屏了整个AI圈——标题简单粗暴:如果趋势持续,Mythos级能力可能在2年内运行在高端消费级硬件上。

来自主题: AI资讯
9054 点击    2026-07-07 10:27
端侧跑大模型,现在也太简单了

端侧跑大模型,现在也太简单了

端侧跑大模型,现在也太简单了

最近,我们都在关注旗舰级大模型的进步,其实本地运行的 AI 模型也迎来了重要的分水岭。

来自主题: AI技术研报
8550 点击    2026-06-24 16:58
首创TTFA指标!港大团队开源FASTER,让VLA模型真正实现「即刻响应」

首创TTFA指标!港大团队开源FASTER,让VLA模型真正实现「即刻响应」

首创TTFA指标!港大团队开源FASTER,让VLA模型真正实现「即刻响应」

具身智能正以前所未有的速度发展,VLA 模型展现出越来越强的动作和泛化能力。然而,当我们真正把 VLA 模型部署到物理世界时,一个核心挑战浮出水面:实时性。

来自主题: AI技术研报
9209 点击    2026-05-15 09:55
Factory放大招:AI代理直接「接管你的电脑」,操控VS Code、浏览器、Excel,21万人围观!

Factory放大招:AI代理直接「接管你的电脑」,操控VS Code、浏览器、Excel,21万人围观!

Factory放大招:AI代理直接「接管你的电脑」,操控VS Code、浏览器、Excel,21万人围观!

Factory 发布桌面端应用,让自治 AI 代理(Droids)直接在你的电脑上操控 VS Code、浏览器、终端和 Excel——官方原话是「像你一样操作你的电脑」。多代理并行、持久化机器、本地模型部署一步到位,官方称企业团队采用速度翻倍、会话量暴涨 4.6 倍。发布推文 21 万人围观,近 900 人点赞。

来自主题: AI资讯
12006 点击    2026-04-11 10:38
刚刚,奥特曼光速滑跪背刺Anthropic,OpenAI高调签下军方大单

刚刚,奥特曼光速滑跪背刺Anthropic,OpenAI高调签下军方大单

刚刚,奥特曼光速滑跪背刺Anthropic,OpenAI高调签下军方大单

就在奥特曼公开支持 Anthropic、声称反对五角大楼施压后不到 12 小时,剧情发生了戏剧性逆转。刚刚,奥特曼在 X 上连发三条相同的帖子,宣布 OpenAI 已与美国五角大楼达成协议,将模型部署到他们的机密网络中。

来自主题: AI资讯
10517 点击    2026-02-28 15:35
把超算装进背包:ThinkStation PGX重新定义AI开发者的生产力边界

把超算装进背包:ThinkStation PGX重新定义AI开发者的生产力边界

把超算装进背包:ThinkStation PGX重新定义AI开发者的生产力边界

随着AI浪潮的袭来,笔者本人以及团队都及时的调整了业务方向,转型为一名AI开发者和AI产品开发团队,常常需要微调大模型注入业务场景依赖的私域知识,然后再把大模型部署上线进行推理,以支撑业务智能体或智能问答产品的逻辑流程。

来自主题: AI资讯
8625 点击    2026-01-22 11:58
长序列推理不再卡顿!北大华为KV缓存管理框架实现4.7倍推理加速

长序列推理不再卡顿!北大华为KV缓存管理框架实现4.7倍推理加速

长序列推理不再卡顿!北大华为KV缓存管理框架实现4.7倍推理加速

北大华为联手推出KV cache管理新方式,推理速度比前SOTA提升4.7倍! 大模型处理长序列时,KV cache的内存占用随序列长度线性增长,已成为制约模型部署的严峻瓶颈。

来自主题: AI技术研报
8106 点击    2025-10-22 14:52