Agent专用搜索AnySearch登顶Product Hunt,Token更省搜得更准
Agent专用搜索AnySearch登顶Product Hunt,Token更省搜得更准本期Product Hunt周榜Top 1出自中国团队,AnySearch——一款AI搜索产品。过去一年,PH榜一的位置被Agent、AI IDE、大模型轮番占据,几乎没见过搜索类产品的影子。就是因为在全球开发者眼里,普通AI搜索已经很难突围了。
搜索
本期Product Hunt周榜Top 1出自中国团队,AnySearch——一款AI搜索产品。过去一年,PH榜一的位置被Agent、AI IDE、大模型轮番占据,几乎没见过搜索类产品的影子。就是因为在全球开发者眼里,普通AI搜索已经很难突围了。
奖励模型(Reward Model, RM)是大语言模型对齐的核心组件,负责为模型输出提供符合人类偏好的评价信号。现有方法各有短板:标量判别式 RM 高效稳定但可解释性有限;生成式 judge 能给出判断理由,却需为每个样本生成长 reasoning,token 与延迟开销显著。
卷起来了!
我把那种号称能省 Token、要求 AI 尽量少说话的 Skill,叫做“电报体 Skill”。
前几天在 github 上有个开源项目非常的火爆,就是 甲木 × 摸鱼小李 大佬联名首发的公众号排版 Skill ,不仅是设计有美感,而且又简约清新,不到几天,就斩获了 1.9k 的 stars
一夜之间,Codex 大改版迎来风评反转。先看网友 signulll 的暴击:「你们把地球上最熟悉的 AI 产品,按自己的组织架构图重新设计了一遍。绝了。」博主 M.G. Siegler 更是直接发文,标题就叫《ChatGPT 的超级 App 简直糟糕烂透了》。他上手几个小时后的体验大概是这样的:
就在刚刚,GPT-5.6 系列正式登场,一口气发布三个型号:旗舰 Sol、均衡款 Terra,还有主打性价比的 Luna,名字分别取自拉丁语里的太阳、地球/大地和月亮。价格上,Sol 每百万 token 输入 5 美元、输出 30 美元;Terra 直接减半,2.5 美元和 15 美元;Luna 最便宜,只要 1 美元和 6 美元。
由阿里巴巴集团孵化的空间智能企业“元境”,正在内测“JellyToken”,平台定位AI大模型一站式超市,支持一套密钥调用多款模型。该平台整合了Qwen3.7、Seedance2.0等多款国产大模型,面向个人创作者、中小团队、企业推出付费统一调用服务。
曾经人们讨论前沿模型时,话题通常是「它有多强」「它比竞品快多少」「它能取代什么工作」。但这一次,有人开始问它能不能跑在端侧。不过说实话,这个想法目前放在 Fable 5 身上,还是太乐观了,这毕竟是 Anthropic 第一个 Mythos 级的公开模型,100 万 token 上下文窗口,专为长时间异步任务设计
7月2日,字节 Seed 发布了一个 Agent评测项目 EdgeBench。看起来又是一个 benchmark,但它问了一个其他榜单不问的问题。EdgeBench 的切口就是把盲区里的东西放进评测,解答一个问题:把Agent扔进一个陌生环境,12小时后,你能变强多少?