连夜实测 Kimi K3,建议改名 Kable
连夜实测 Kimi K3,建议改名 Kable今天凌晨看到 Arena AI 更新 Code Arena 榜单时,我第一反应是有点意外。刚刚发布的 Kimi K3 拿到了 1679 分,排在全球第一,压过了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。
搜索
今天凌晨看到 Arena AI 更新 Code Arena 榜单时,我第一反应是有点意外。刚刚发布的 Kimi K3 拿到了 1679 分,排在全球第一,压过了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。
「喏,就是你!你以为我要宣布重置吗?其实不是。我只是在刷推特,看看大家对 ChatGPT Work 有什么反馈意见。」
GPT-5.6发布之后,Codex开始以一种近乎夸张的速度增长。
昨天那篇文章,我说了一下我现在用Agent的日常。
Codex 首款硬件,来了。
Raft是一个很神奇的AI产品。当它还叫Slock的时候,我认为这主要是一个投资人自嗨产物。除了极少数自己充了Claude、Codex会员,同时本地电脑还有Opencode、Pi等一系列Agent的极致变态电子佬用户,没人需要一个AI群聊。
最近我在给 Codex 折腾一只自己的桌宠。
又送了! 就在刚刚,Codex与ChatGPT Work的活跃用户大军,合体突破800万大关。
最近一段时间,越来越多人开始讨论一个词:Loop。刚开始看到这个说法,我也觉得有点抽象。Agent 本身不就会反复思考、调用工具、修改代码吗?为什么还要专门设计一个 Loop?周末两天看完 Claude Code 团队写的一篇文章,我才发现,这件事其实没有那么玄乎。
国产Coding模型杀疯了!实测1分20秒闭环真实Bug,1395行代码徒手捏出《我的世界》,长程工程能力直逼Opus 4.8,不用再当AI保姆了。这款装入CC的AI,就是快手发布的KAT-Coder-Pro V2.5,一款旗舰级的Agentic Coding模型。