AI资讯新闻榜单内容搜索-deepseek

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: deepseek
马卡龙的下注:把模型后训练,做成企业服务

马卡龙的下注:把模型后训练,做成企业服务

马卡龙的下注:把模型后训练,做成企业服务

Mind Lab(马卡龙)正式发布面向企业的模型后训练与推理平台 Mint Recursive,将其从 Macaron V1.1 训练实践中沉淀的 MinT 底层系统、自动化训练与迭代管线以托管服务形式开放给企业,支持 GLM、Qwen、DeepSeek、Kimi、MiniMax 等开源基座及监督微调、强化学习、全参数训练和 LoRA。

来自主题: AI资讯
9310 点击    2026-09-24 10:10
DeepSeek新论文公开Agent训练!梁文锋署名

DeepSeek新论文公开Agent训练!梁文锋署名

DeepSeek新论文公开Agent训练!梁文锋署名

大模型训练拼的是算力,Agent训练拼的是环境。

来自主题: AI技术研报
9093 点击    2026-09-23 18:04
8万亿,梁文锋也开始卷“超大”

8万亿,梁文锋也开始卷“超大”

8万亿,梁文锋也开始卷“超大”

DeepSeek正训练约2万亿参数的新模型,并计划将后续模型参数规模进一步推至8万亿,加入新一轮超大参数模型竞赛。

来自主题: AI资讯
9394 点击    2026-09-23 16:08
刚刚,小米刷新 AI 大模型斩杀线,罗福莉:技术难度超过 DeepSeek R1

刚刚,小米刷新 AI 大模型斩杀线,罗福莉:技术难度超过 DeepSeek R1

刚刚,小米刷新 AI 大模型斩杀线,罗福莉:技术难度超过 DeepSeek R1

小米正式发布并开源 MiMo-V2.6 系列模型,罗福莉称其背后的研究创新和工程难度超过 DeepSeek R1,在 Artificial Analysis Intelligence Index v4.3 中以 46.32 分成为当前得分最高的开源模型,价格仅为海外同级模型的 1/20 至 1/60。

来自主题: AI资讯
9650 点击    2026-09-22 15:43
于是转身向具身走去|对话王家伟:深朴智能00后首席科学家

于是转身向具身走去|对话王家伟:深朴智能00后首席科学家

于是转身向具身走去|对话王家伟:深朴智能00后首席科学家

深朴智能24岁首席科学家王家伟在播客对话中回顾了从中科大少年班、MSRA、DeepSeek到字节Seed的经历,阐述放弃大模型舒适区转向具身智能创业的原因,认为具身系统既需要通用大模型承担理解与规划,也需要能毫秒级快速反应的动作模型,并介绍了深朴智能在开源HiFi-UMI数据集、自研高精度UMI手套及构建Agentic OS方面的全栈研发进展。

来自主题: AI资讯
8381 点击    2026-09-20 15:08
全球基模决战!AI圈休不了十一长假了

全球基模决战!AI圈休不了十一长假了

全球基模决战!AI圈休不了十一长假了

Anthropic、谷歌、OpenAI、Kimi、DeepSeek及阿里Qwen等全球AI大厂正密集备战,在中秋国庆假期前后集中推出或预告Claude 5.2、Gemini 4 Pro、Kimi K3.1、DeepSeek V4.1 Pro、Qwen4等旗舰基模,集体围攻OpenAI此前发布的GPT-6 Astra。

来自主题: AI资讯
8328 点击    2026-09-20 15:07
你每月花钱养的办公Agent,最后成了谁的资产?

你每月花钱养的办公Agent,最后成了谁的资产?

你每月花钱养的办公Agent,最后成了谁的资产?

文章指出当办公Agent深度介入工作后,用户面临工作方式主导权被平台锁定的风险,认为模型开源不等于Agent开源,Agent Runtime开源才是关键,并以DeepSeek发布的Harness和网易有道开源的LobsterAI(含OpenClaw)为例,说明开源Agent Runtime能为用户带来数据主权、可审计性、连续性和可定制性。

来自主题: AI技术研报
9363 点击    2026-09-19 10:58