AI资讯新闻榜单内容搜索-压缩

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 压缩
英伟达HBM告急!下一代GPU受限,这块硬盘却抢走风头

英伟达HBM告急!下一代GPU受限,这块硬盘却抢走风头

英伟达HBM告急!下一代GPU受限,这块硬盘却抢走风头

功能型SSD在这条数据链中的合理角色,不是自行判断一段经历是否值得记住,而是在Runtime已经给出对象和策略后,靠近数据执行确定性工作。例如按租户选择密钥,按生命周期放置数据,压缩与去重可缩减的对象,维护索引页与元数据,优先完成即将被推理使用的回载,并把尾延迟、写放大和介质健康反馈给上层。语义决策留在Agent和Runtime,数据执行尽量靠近介质。

来自主题: AI技术研报
7776 点击    2026-08-11 10:22
600倍加速,720p视频实时生成!单卡也能带的动14B模型

600倍加速,720p视频实时生成!单卡也能带的动14B模型

600倍加速,720p视频实时生成!单卡也能带的动14B模型

LightX2V团队面向Wan2.2-A14B推出LightWan2.2-A14B,以步数蒸馏、NVFP4量化感知训练和动态稀疏注意力压缩计算量,再用高效算子、细粒度卸载和多卡通信优化打通整条推理链路。

来自主题: AI技术研报
8557 点击    2026-08-07 13:53
对话斯坦福吴英成:下一代AI,要“蒸馏地球”

对话斯坦福吴英成:下一代AI,要“蒸馏地球”

对话斯坦福吴英成:下一代AI,要“蒸馏地球”

采访中,吴英成把自己正在做的事压缩成一句话:“上一代 AI 蒸馏的是互联网,下一代 AI for Science 应该‘蒸馏地球’。”

来自主题: AI资讯
8108 点击    2026-07-29 14:02
现在还不会给Agent选装记忆?清华上交大横评12个主流记忆框架,省掉你3个月的试错

现在还不会给Agent选装记忆?清华上交大横评12个主流记忆框架,省掉你3个月的试错

现在还不会给Agent选装记忆?清华上交大横评12个主流记忆框架,省掉你3个月的试错

市面上已有几十种Agent记忆方案,有的基于向量检索,有的基于知识图谱,有的靠定期总结“压缩”对话,有的则完全依赖模型自身的上下文窗口。它们各有各的说法,但在系统层面,到底哪种方案靠得住?哪种方案在你的工作负载下既不贵又准?

来自主题: AI技术研报
8751 点击    2026-07-20 10:42
提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026

提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026

提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026

现在的 AI Agent 动辄需要处理超长上下文,既要看系统提示词、工具说明,又要翻阅历史对话和检索文档。为了省钱、省算力并降低延迟,很多开发者会给系统加上 “提示词压缩”(Prompt Compression)模块,把冗长的上下文浓缩后再喂给大模型。

来自主题: AI技术研报
9124 点击    2026-07-08 15:03
怎么让 ChatGPT 在别人搜你对手名字时,推荐你

怎么让 ChatGPT 在别人搜你对手名字时,推荐你

怎么让 ChatGPT 在别人搜你对手名字时,推荐你

以前:搜 Google → 开 8 个标签页 → 对比功能 → 约演示 → 买。现在:搜那个默认大牌 → 再搜「某某大牌 的替代品」→ 从冒出来的 3 个名字里挑一个 → 约演示 → 买。整条对比研究,被 AI 一次答复压缩成了「三选一」

来自主题: AI资讯
8506 点击    2026-07-06 10:25
Jumper跳槽Anthropic后复盘AlphaFold的苦涩教训:成功源于定制化架构,根本不靠堆算力

Jumper跳槽Anthropic后复盘AlphaFold的苦涩教训:成功源于定制化架构,根本不靠堆算力

Jumper跳槽Anthropic后复盘AlphaFold的苦涩教训:成功源于定制化架构,根本不靠堆算力

如果我们谈到 AI 赋能带来的科学突破,AlphaFold 一定是不可忽略的一项。它解决了困扰生物学界半个多世纪的蛋白质折叠难题,大量压缩了得到蛋白质结构的时间,从原来的一年,到现在的几分钟。它的核心开发者之一 John Jumper 也因这一贡献在 2024 年摘得诺贝尔化学奖。

来自主题: AI资讯
9785 点击    2026-06-27 12:23
Claude惊人真相被教授曝光:思考过程加密,给钱也看不到!

Claude惊人真相被教授曝光:思考过程加密,给钱也看不到!

Claude惊人真相被教授曝光:思考过程加密,给钱也看不到!

当初,Anthropic推出extended thinking的时候,把它包装成「让用户看到思考过程」的透明标杆。现在真相是:你看到的只是他们允许你看到的部分。那些被加密、被压缩、被锁在全局密钥里的内容,藏着什么?

来自主题: AI技术研报
10400 点击    2026-06-24 16:36
直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能

直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能

直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能

今天几乎所有主流视觉语言模型(VLM)—— 无论是 Qwen-VL、InternVL,还是 LLaVA 系列 —— 都遵循着同一套经典架构:先用预训练视觉编码器(如 CLIP、SigLIP)将图像压缩为特征,再通过投影层把这些特征送入大语言模型。

来自主题: AI技术研报
8064 点击    2026-06-24 16:06