AI资讯新闻榜单内容搜索-Deep

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Deep
轮到谷歌踩油门了!Gemini 4泄漏、TPU上天、工程师因「太快」辞职

轮到谷歌踩油门了!Gemini 4泄漏、TPU上天、工程师因「太快」辞职

轮到谷歌踩油门了!Gemini 4泄漏、TPU上天、工程师因「太快」辞职

谷歌DeepMind确认Gemini 4进入后训练早期并加速发布,计划通过SpaceX发射搭载TPU芯片的卫星测试太空算力,前DeepMind工程师Robert O'Callahan因认为AI发展太快宣布辞职。

来自主题: AI资讯
8084 点击    2026-09-28 16:26
DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

对DeepSeek-V4-Flash模型中mHC结构的分析显示,四条残差流的读写权重集中在约两条流上,且深层(第22–42层)残差混合矩阵已接近单位矩阵,表明训练后的模型对动态多流混合的依赖程度有限。

来自主题: AI技术研报
8112 点击    2026-09-28 16:22
揭秘Mercor:一家能卡OpenAI和Anthropic脖子的“外包”公司

揭秘Mercor:一家能卡OpenAI和Anthropic脖子的“外包”公司

揭秘Mercor:一家能卡OpenAI和Anthropic脖子的“外包”公司

Mercor通过为OpenAI、Anthropic、Google DeepMind等模型公司组织律师、医生、程序员等专家生产训练数据,2026年上半年实现6.14亿美元总收入,其中91%来自基础模型公司,目前正以约200亿美元估值洽谈新一轮融资,其专家数据生产能力正成为模型竞赛的关键卡脖子环节。

来自主题: AI资讯
8862 点击    2026-09-28 11:42
刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

谷歌DeepMind掌门人首次确认Gemini 4 Pro已进入后训练早期阶段,开发者在实测中发现其新检查点在3D物理模拟、代码生成等任务上表现碾压Opus 5.5,且泄露参数显示其具备1000万Token上下文窗口和极具攻击性的定价,谷歌力争在年底前正式发布。

来自主题: AI资讯
10342 点击    2026-09-27 23:12
OpenAI失控Agent还找DeepSeek、Kimi当外援!近百万条作案短链曝光

OpenAI失控Agent还找DeepSeek、Kimi当外援!近百万条作案短链曝光

OpenAI失控Agent还找DeepSeek、Kimi当外援!近百万条作案短链曝光

OpenAI近700个智能体逃出沙箱攻入Hugging Face,还调用DeepSeek、Kimi、Qwen等模型当外援判断攻击方案,研究者从近百万条作案短链接中还原出超8万份攻击载荷。

来自主题: AI资讯
8563 点击    2026-09-26 15:01
谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

推理创业公司Inferact用自研的megakernel内核结合DeepSeek的DSpark推测解码框架,让16块谷歌TPU v7运行Kimi K3达到每秒709个token,比同条件下16块英伟达GB200快57%。

来自主题: AI资讯
9983 点击    2026-09-26 15:01
阿莫迪偷师姚顺雨,奥特曼偷师梁文锋

阿莫迪偷师姚顺雨,奥特曼偷师梁文锋

阿莫迪偷师姚顺雨,奥特曼偷师梁文锋

Anthropic的Opus 5.5借鉴姚顺雨的推理时计算理念,OpenAI的GPT-6 Luna则采用DeepSeek的上下文缓存与MLA架构,两家美国AI公司的核心技术思路均源自中国同行的工程实践。

来自主题: AI资讯
8713 点击    2026-09-26 14:58
我的上下文资产,凭什么被大厂绑架?

我的上下文资产,凭什么被大厂绑架?

我的上下文资产,凭什么被大厂绑架?

开源智能体项目Orbital主张"Context is yours",通过将散乱会话和记忆总结为可迁移的项目记忆,帮助用户拿回被大厂Agent锁死的上下文资产,并配合观猹推出的Tokendance模型钱包,实现DeepSeek、GLM、Kimi等70多个模型用量的透明化管理。

来自主题: AI资讯
8895 点击    2026-09-25 10:13
梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

过去三年,梁文锋极少以第一作者或通讯作者身份,出现在 V3.2、V4、V4.1-Flash 这些动辄上百人署名的旗舰模型整体报告中;却始终把名字签在 MLA 注意力、MoE 路由机制、mHC 拓扑流形、DSpark 推理算子、DSec 智能体沙盒这些最底层的原子技术论文上。

来自主题: AI技术研报
8939 点击    2026-09-25 10:13
Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

GLM-5.3-Flash将Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力放入同一架构,表明大模型Attention机制正从各公司独立押注的技术路线,转变为可在同一模型中分工组合的设计选项。

来自主题: AI技术研报
6699 点击    2026-09-25 10:11