AI资讯新闻榜单内容搜索-GPU

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPU
笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub

笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub

笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub

GitHub火热开源项目Colibrì以纯C实现分层推理框架,通过AI内存多层化将SSD、RAM和VRAM组成动态调度系统,无需GPU即可让普通笔记本运行744B参数GLM-5.2等超大MoE模型,已揽获32k Star并支持9个模型家族。

来自主题: AI资讯
9690 点击    2026-09-26 15:01
谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

推理创业公司Inferact用自研的megakernel内核结合DeepSeek的DSpark推测解码框架,让16块谷歌TPU v7运行Kimi K3达到每秒709个token,比同条件下16块英伟达GB200快57%。

来自主题: AI资讯
9940 点击    2026-09-26 15:01
PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

是石科技自研Meta-Infer高效推理引擎通过内核补齐、算子通信重构、并行调优与缓存复用等纯软件手段,在不改动模型前提下将DeepSeek-V4.1-Flash在PCIe显卡上的推理吞吐提升近7倍,该方法论同样适用于DeepSeek-V4-Flash、GLM5.3及国产GPU。

来自主题: AI资讯
7965 点击    2026-09-25 10:09
速递|AI基础设施公司Cornelis获2.05亿美元融资

速递|AI基础设施公司Cornelis获2.05亿美元融资

速递|AI基础设施公司Cornelis获2.05亿美元融资

AI基础设施公司Cornelis完成2.05亿美元融资并发布Active Compute Fabric网络技术,以开放架构与Nvidia竞争,解决GPU等待数据造成的算力浪费问题。

来自主题: AI资讯
8835 点击    2026-09-20 15:09
KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

大模型越来越会 “想”,也越来越能把 GPU 显存 “想满”。 在数学、科学问答和代码生成等任务中,reasoning model 往往会生成数千乃至数万 token 的长推理链。随着生成持续进行,每

来自主题: AI技术研报
8735 点击    2026-09-20 11:05
jina-ocr-v1:在低成本 GPU 上更快解析文档

jina-ocr-v1:在低成本 GPU 上更快解析文档

jina-ocr-v1:在低成本 GPU 上更快解析文档

Jina AI 发布端到端文档解析模型 jina-ocr-v1,以 3.4B 总参数/570M 激活参数在 OmniDocBench v1.6 与 olmOCR-Bench 上刷新同级别最佳成绩,并凭借 FastMTP 推测解码与分级密集奖励在低成本 GPU 上实现无损近倍速生成,单页仅输出 1085 个 token 以 2.57 页/秒吞吐领跑 14 款主流系统。

来自主题: AI资讯
9411 点击    2026-09-18 17:29
刚写完V4.1主算子就要“转业”?DeepSeek资深工程师深夜独白

刚写完V4.1主算子就要“转业”?DeepSeek资深工程师深夜独白

刚写完V4.1主算子就要“转业”?DeepSeek资深工程师深夜独白

DeepSeek资深MLSys工程师刘胜与深夜发文,坦承刚完成V4.1核心算子交付后,意识到AI已能自主编写和优化GPU算子,正迫使他从手写底层算子转向驾驭AI Agent的"机甲驾驶员",并警示工程底层能力空心化可能带来系统性风险。

来自主题: AI资讯
8927 点击    2026-09-15 14:21
深度解读高通下一代骁龙旗舰芯:CPU、GPU、NPU终极AI进化,黑科技拉满

深度解读高通下一代骁龙旗舰芯:CPU、GPU、NPU终极AI进化,黑科技拉满

深度解读高通下一代骁龙旗舰芯:CPU、GPU、NPU终极AI进化,黑科技拉满

高通提前剧透下一代骁龙旗舰移动平台的核心升级:Oryon CPU首次实现5GHz主频并引入动态缓存架构FlexCache,Hexagon NPU推出Element Accelerator与更大共享内存,Adreno GPU首次加入Matrix Cores并集成AI图形渲染技术Adreno Neural Fusion,全面强化端侧智能体AI性能与体验。

来自主题: AI资讯
8978 点击    2026-09-13 13:06