Fable5仅做对3.5%!大模型会看图,但还没有主动视觉
Fable5仅做对3.5%!大模型会看图,但还没有主动视觉人类看图时,不会先在大脑中拍下一张「截图」,再闭眼推理。思考过程会不断引导我们的目光:找到一个线索,形成一个假设,再回到图像里验证它。
搜索
人类看图时,不会先在大脑中拍下一张「截图」,再闭眼推理。思考过程会不断引导我们的目光:找到一个线索,形成一个假设,再回到图像里验证它。
“用 Vibe Coding 的成本越低,你被模型卷死的概率就越高。”
曾经最相信强化学习的人之一,如今却认为:强化学习没有把我们带到 AGI。
你是一名支持开源的 AI 工程师,正在参加 Anthropic 的文化面试。
上周三晚上,我在旧金山 Brex 总部七楼参加了一场 AI 创业 pitch 活动。办活动的是 Founders Bay,一个号称拥有 20 万创始人、投资人和运营者的社区。
AI奇点,已经临近了!
她是xAI前推理团队负责人。她研究并发起的开源推理引擎SGLang,已经成为众多大模型部署和推理的重要底层工具,也是目前AI infra领域最具影响力的开源推理框架之一。如今,她从SGLang开源生态中孵化出创业公司RadixArk,希望把只有少数科技巨头才能拥有的前沿AI基础设施,变成整个行业都可以使用的开放技术底座。
DeepSeek Harness内测前瞻。
D轮融资估值暴涨约四倍,已签30余份量产合同。
前不久,OpenAI 公布了其智能体入侵 HuggingFace 的 AI 安全事件,令很多企业和公众第一次意识到:AI 模型可能并不总会按照设计好的方式行动。