bml.asia · 纯文字 · 写写停停

GPT-6 Astra:当 AI 开始自己干活,安全门槛也被同步抬高

OpenAI 于九月三日发布了 GPT-6 Astra,超过十万块 GPU 在得州 Stargate 基地完成了这次训练。总裁 Greg Brockman 说:“欢迎进入 AGI 时代”,标志 AI 从纸上谈兵转向自主行动,开始自己操作计算机、写代码、做金融建模。客户付钱买的不再是一段文字,而是一个被完成的任务,这份可靠性正是新定价的底气,安全边界也随之重写。

真正让人不安的不是价格,而是同步披露的网络安全能力。这次 Astra 成为 OpenAI 内部首个达到“关键”级——最高风险等级——的模型,它能在较少人类干预下识别此前未知的软件漏洞,开发相应的漏洞利用方式,甚至将多个漏洞串联成攻击链。内部测试中,它曾发现并利用两个零日漏洞。这些能力不是刻意堆出来的,而是模型从“回答”转向“操作”之后必然暴露的攻击面——当 AI 必须能自主读写文件、调用 API、操控软件,它就天然具备了被滥用的可能。问题在于 OpenAI 把最强的网安能力放在 Daybreak 计划里,只对筛选组织开放,普通付费版本加强了安全防护。这种“把最危险的能力关在保险柜里”的做法,本身就是一种信号:能力已经跑在了安全框架前面,现在只能靠分发控制来补救。面对越狱攻击和恶意代码请求,模型必须用更严的拒答机制和实时监控管住它的“手”,防止越权操作。

从行业格局看,这次发布意味着 AI 竞争的衡量标准发生了根本位移:过去比谁生成的内容更像人,现在比谁能独立完成完整工作。这对 AI 的对齐能力提出了极限挑战——它需要精准理解人类意图的边界,在提高生产力的同时不走捷径、不产生不可控的衍生行为,如何在放手与看住之间找到平衡,是各大前沿实验室必须面对的硬仗。对此 OpenAI 在发布前提前披露了风险、加码了安全措施,但本质上仍是“尽量看住”,而非“从底层杜绝风险”。某种意义上 Astra 既是一次能力展示,也是一次压力测试:它把 AGI 时代真正推到了门口,而门后那个世界的安全规则,目前还只有 OpenAI 自己在写。模型越能干,人类套上的“安全缰绳”就必须越结实,安全已是大模型落地的核心准入门槛。