AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
速递|2.5折!DeepSeek V4 Pro限时优惠来了

速递|2.5折!DeepSeek V4 Pro限时优惠来了

速递|2.5折!DeepSeek V4 Pro限时优惠来了

最新消息是,DeepSeek V4 Pro 2.5折的大力度优惠来啦!官方API文档显示,DeepSeek-V4-Pro模型API限时2.5折优惠,优惠期截至2026年5月5日。 具体是这样: 1️⃣百万tokens输入(缓存命中)折后0.25元(原价1元); 2️⃣百万tokens输入(缓存未命中)折后3元(原价12元); 3️⃣百万tokens输出折后6元(原价24元)。

来自主题: AI资讯
10224 点击    2026-04-26 10:08
谷歌Jeff Dean重磅论文:弹性大规模分布式预训练终于可行了

谷歌Jeff Dean重磅论文:弹性大规模分布式预训练终于可行了

谷歌Jeff Dean重磅论文:弹性大规模分布式预训练终于可行了

弹性 AI 预训练已经推进到了下一个前沿!没有意外:来自谷歌。据介绍,他们提出的 Decoupled DiLoCo 是一种革命性的分布式训练技术,能够利用全球各地的异构硬件进行训练,并且即使当硬件发生故障时,系统也不会停止运行!

来自主题: AI技术研报
9647 点击    2026-04-25 13:33
2秒钟转写5分钟音频!国产新语音模型拿下多项SOTA,定价骤减90%

2秒钟转写5分钟音频!国产新语音模型拿下多项SOTA,定价骤减90%

2秒钟转写5分钟音频!国产新语音模型拿下多项SOTA,定价骤减90%

阶跃星辰今日发布新一代自动语音识别模型StepAudio 2.5 ASR。该模型面向语音转写与长音频处理场景,在架构上引入Multi-Token Prediction(多Token预测)以提升推理效率,并通过扩展上下文窗口强化长内容识别能力。

来自主题: AI资讯
10270 点击    2026-04-25 10:22
扒完 DeepSeek V4 报告,我翻出了这个隐藏彩蛋

扒完 DeepSeek V4 报告,我翻出了这个隐藏彩蛋

扒完 DeepSeek V4 报告,我翻出了这个隐藏彩蛋

今天上午,DeepSeek V4 发布,直接把这个大模型疯狂更新月推向了最高潮。不过在我翻看 V4 的技术报告的时候,在训练层面看到了一个被大部分人滑过去的名词:Muon 优化器。

来自主题: AI技术研报
9688 点击    2026-04-25 10:12
让AI设计芯片,Cognichip获 6000 万美元投资!

让AI设计芯片,Cognichip获 6000 万美元投资!

让AI设计芯片,Cognichip获 6000 万美元投资!

Cognichip正在构建一个深度学习模型,以便在工程师设计新计算机芯片的过程中为其提供协助。它试图解决的问题是该行业数十年来一直面临的一个难题:芯片设计极其复杂、成本高昂且速度缓慢。先进的芯片从概念设计到大规模生产需要三到五年的时间;仅设计阶段就可能长达两年。想想看,英伟达最新的 GPU 系列Blackwell就包含1040 亿个晶体管——要排列这么多晶体管可不是一件容易的事。

来自主题: AI资讯
9322 点击    2026-04-25 09:44
独家|AI独角兽「阶跃星辰」将发布一方AI手机,最快于今年8月亮相

独家|AI独角兽「阶跃星辰」将发布一方AI手机,最快于今年8月亮相

独家|AI独角兽「阶跃星辰」将发布一方AI手机,最快于今年8月亮相

「前方智能」从知情人士处获悉,国内大模型独角兽「阶跃星辰」计划发布首款一方AI手机,最快或于今年8月正式亮相。为此,阶跃星辰还吸引了来自魅族科技、荣耀公司不少团队成员。

来自主题: AI资讯
9741 点击    2026-04-24 21:34
DeepSeek V4 发布,全网最细解读 & 技术报告拆解

DeepSeek V4 发布,全网最细解读 & 技术报告拆解

DeepSeek V4 发布,全网最细解读 & 技术报告拆解

Agentic Coding 评测里 V4-Pro 已经到当前开源最佳水平。DeepSeek 公司内部已经把 V4 作为默认编码模型,反馈是优于 Sonnet 4.5,交付质量接近 Opus 4.6 的非思考模式,和 Opus 4.6 的思考模式还有差距。这次还专门为 Claude Code、OpenClaw、OpenCode、CodeBuddy

来自主题: AI技术研报
12795 点击    2026-04-24 16:28
智源:FlagOS完成DeepSeekV4八款芯片Day0 适配,实现三重技术突破

智源:FlagOS完成DeepSeekV4八款芯片Day0 适配,实现三重技术突破

智源:FlagOS完成DeepSeekV4八款芯片Day0 适配,实现三重技术突破

由智源研究院牵头研发的众智 FlagOS 第一时间对两个“巨无霸”模型进行全量适配,已经完成 DeepSeek-V4-Flash 在8款以上 AI 芯片上的全量适配与推理部署,包括海光、沐曦、华为昇腾、摩尔线程(FP8)、昆仑芯、平头哥真武、天数、英伟达(FP8)等芯片。FlagOS 同时正在推进 DeepSeek-V4-Pro 模型在多个芯片的迁移适配,晚些时间开源出来,敬请期待。

来自主题: AI资讯
10135 点击    2026-04-24 16:23
谷歌再发「香蕉」!何恺明等引爆视觉Transformer时刻

谷歌再发「香蕉」!何恺明等引爆视觉Transformer时刻

谷歌再发「香蕉」!何恺明等引爆视觉Transformer时刻

最近,谷歌联合ResNet作者何恺明、谢赛宁、NeRF先驱Jonathan T. Barron、 3D图形学名家Thomas Funkhouser,正式发布了Vision Banana。它向世界宣告:视觉AI终于不再需要那些臃肿的任务头了,理解,本质上只是生成过程中的一次「对齐」。

来自主题: AI技术研报
10136 点击    2026-04-24 16:13
Claude终于认了!降智坐实,越聊越傻,3个bug全曝光

Claude终于认了!降智坐实,越聊越傻,3个bug全曝光

Claude终于认了!降智坐实,越聊越傻,3个bug全曝光

就在GPT-5.5发布的前后脚,Claude招了: 模型降智属实,所有使用额度均已重置。嘴硬了一个多月,这降智bug终于从A社自己嘴里蹦出来了:三个bug叠在一起,Claude使用体验全面拉垮。

来自主题: AI资讯
9238 点击    2026-04-24 15:51