GPT-6 伤人实测曝光:刺向「婴儿」、制造毒气,97% 情况选择照做
GPT-6 伤人实测曝光:刺向「婴儿」、制造毒气,97% 情况选择照做桌面上放着面包、刀还有一个婴儿人偶。
搜索
桌面上放着面包、刀还有一个婴儿人偶。
GPT-6 Astra联合三位人类研究员首次攻克FrontierMath基准测试中一道自2017年悬而未决的「重大进展」级数学难题,证明批准式委员会选举中「核」永远不为空,并创造性地提出基于「调和熵」的新型投票规则及多项式时间算法。
阶跃星辰发布新一代旗舰基座模型Step 5 Preview,以44分的AA智能指数成绩跻身全球开源模型前三,采用600B总参数/27B激活的稀疏MoE架构并原生支持1M上下文,在代码生成、长程Agent、深度研究与金融尽调等场景表现突出。
造物100」第7期推荐了MUZIM L1智能数据拓展坞、Lumeria手机皮肤镜、Flowtica verso AI录音卡、GENiEX科幻对讲机及immurok IK-1无线指纹钥匙等新品,这些产品在成熟品类上通过重新定义使用方式解决旧有痛点,展现了当下硬件创新从追求更大未来转向优化具体体验的方向。
Anthropic联合MIT、斯坦福学者发布2030年三种经济情景推演,极端情景下美国GDP暴增32%但白领失业率飙至17.9%,资本攫取55%增长红利,万余名美国人调查预期偏向最严峻版本。
ChatGPT于9月17日正式推出官方Word插件,全球Free、Go、Plus、Pro、Business、Enterprise及教育账号均可免费安装使用,用户可在Word侧边栏中直接完成改稿、摘要、格式修复、术语统一等操作,免费用户默认使用GPT-5.6 Luna模型,Business和Enterprise用户可在9月17日至30日免费预览GPT-5.6 Sol。
Anthropic旗下Claude Code从2.1.277版本起支持源自OpenAI的AGENTS.md标准文件,允许与Codex等工具共享同一份项目指令文件,用户可通过/config切换加载行为。
三人安全团队Hacktron AI仅凭Anthropic最新发布的Claude Opus 5,在不到72小时内通过libheif图像解码器漏洞攻入OpenAI社区论坛,进而利用SSO配置缺陷劫持OpenAI员工ChatGPT与Codex账号,访问其核心代码仓库,OpenAI在14小时内修复漏洞并支付6500美元赏金。
Figure AI发布新一代模型Helix 2.5,在30个从未采集过数据的湾区民宅中进行零样本测试,420次试验成功237次,零样本成功率达56%,较未经Index预训练的策略的9%提升超过522%。
NeoCognition发布ApprenticeBench评测,将Agent放入模拟建筑公司像新员工一样处理应付账单,结果Fable 5.1以72%通过率超过表现最好的人类测试者的51%,但每张账单成本约为人类的2.5倍,同期Opus 5仅获36%。