笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub
笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHubGitHub火热开源项目Colibrì以纯C实现分层推理框架,通过AI内存多层化将SSD、RAM和VRAM组成动态调度系统,无需GPU即可让普通笔记本运行744B参数GLM-5.2等超大MoE模型,已揽获32k Star并支持9个模型家族。
搜索
GitHub火热开源项目Colibrì以纯C实现分层推理框架,通过AI内存多层化将SSD、RAM和VRAM组成动态调度系统,无需GPU即可让普通笔记本运行744B参数GLM-5.2等超大MoE模型,已揽获32k Star并支持9个模型家族。
斑马智能在2026云栖大会发布面向智能终端的全模态端侧大模型AutoOmni 2.0-23B-A3B,主张智能汽车是具身智能最大的中试场,端侧AI基础设施将决定AI能否在真实世界被真正深度使用。
骁龙首次双旗舰齐发,最高8核CPU、GPU内置AI核、NPU内存扩容,安卓旗舰大战正式开打。
静态互联网数据的增长红利,见顶了。
元空智能联合惠普发布端侧AI方案,推出涵盖27B稠密与35B-A3B稀疏版本的Boxer系列模型以及AI Work、AI Science两套Agent,主张"设备即环境"理念,强调原生端侧模型才是AI未来发展方向。
端侧AI算力基础设施公司烨知心(Yeats.AI)完成Pre-A轮融资,成立一年累计融资近10亿元,由深创投、和利资本、TCL创投、中科创星联合领投,创始团队来自苹果Apple Neural Engine团队,专注面向Agentic与Physical AI的下一代NPU软硬件研发。
全球4B参数规模以下开源基座模型的新榜首,居然是一个2B模型
过去几年,端侧大模型一直在不断突破能力边界。
很多人以为,把一个大模型放进手机或电脑,就像下载一个 App 一样简单。实际上,手机、电脑和智能硬件的芯片各不相同,同一个模型换一台设备,往往就要重新适配。Nexa AI 做的,就是解决这部分最麻烦也最容易被忽视的工作。
端侧AI持证上岗了。