重磅 官方发布
OpenAI公开承认:未发布新模型Astra可能已达"Critical"级网络安全能力,行业史上首次
OpenAI于8月7日发文披露,其内部评估显示,尚未发布的新一代模型Astra"不能排除"已经达到该公司《预备框架》(Preparedness Framework)中定义的网络安全"Critical"(最高)风险等级——即模型能够独立识别并开发出针对多类高防护现实关键系统、覆盖各严重级别的零日漏洞利用,或仅凭高层目标就能自主设计并执行端到端的新型网络攻击策略。这是自各大实验室建立"预备框架"类安全评估体系以来,首次有公司公开承认自家模型可能触及最高风险档位。OpenAI表示已暂停Astra不满足更严格安全管控要求的部分内部活动,并对所有涉及该模型的智能体应用(含训练与评测环节)实施全面监控;同时强调Astra此前并未被用于此前媒体报道的Hugging Face入侵事件。CEO Sam Altman在X上确认发布会因此推迟,称"我们需要多一点时间才能安全地做这件事,但希望不会太久"。
为什么重要: 这是行业首次由头部实验室主动、公开地把自家模型标记到"可自主完成端到端网络攻击"这一最高风险档位,把此前更多停留在理论讨论中的"AI自主黑客"风险第一次落到了具体产品和具体日期上,也为其他实验室的安全披露树立了一个新的透明度标杆(或者说,制造了新的舆论压力)。
影响谁: 直接影响Astra及后续同代模型的发布节奏和商用授权范围;对网络安全行业而言,"用AI帮防守方"和"AI可能被攻击方滥用"两种叙事同时被推上台面;对监管者而言,这为白宫此前拟定的前沿模型自愿测试框架提供了第一个现实案例;对普通用户影响相对间接,但会进一步强化"强模型必须配强监管"的公众预期。
后续看点: Astra最终能否通过强化后的安全评估并正式发布;是否会有其他实验室跟进披露类似风险等级;批评者认为这是"恐惧营销"的质疑会否影响OpenAI的可信度;白宫自愿框架下的联邦测试机制是否会因此事加速落地。
X 热议榜
官方发布
1 · OpenAI官方账号+Altman本人接连发帖,罕见"自曝家丑"式沟通引全网转发
OpenAI官方X账号发文:"在评估了我们即将推出的模型Astra后,我们正将其视为预备框架下首个网络安全'Critical'级模型。这是我们此前已经规划应对的场景,我们正在为确保Astra的后续开发部署额外管控措施。"Sam Altman随后转发确认发布会推迟,语气坦诚甚至带有口误("we need a little big longer"),被网友截图广泛传播。支持者认为这种主动公开的姿态值得肯定,为行业树立了透明度先例。
争议
2 · 质疑声浪:这是真安全预警,还是"制造焦虑感"的营销话术
部分安全研究者和评论人士在X上提出,OpenAI只是宣称"不能排除"达到Critical级,而非确认已经达到该等级,措辞上留了余地,这种"预警式披露"客观上会强化公众对其技术领先地位的印象,被部分批评者视为"恐惧营销"。也有网络安全从业者反驳称,无论动机如何,把"AI可能自主完成端到端网络攻击"这件事摆上台面本身就有价值,好过闷声不响地继续训练。双方在评论区争论激烈,尚未达成共识。
官方发布
3 · ChatGPT免费用户无限畅聊+GPT-5.6 Luna当家,本周起全量铺开
OpenAI宣布取消ChatGPT免费用户"每5小时10条消息"的旧上限,本周(8月10日当周)起免费与Go用户默认改用新模型GPT-5.6 Luna提供无限文字对话,无需绑定信用卡;文件上传、图片生成等能力仍保留限制,对话仍默认用于模型训练。X上讨论集中在"AI边际成本趋近于零"这一信号,也有用户调侃"终于不用精打细算地问ChatGPT问题了"。
媒体报道
4 · 阿里Qwen3.8-Max本周开源权重,网友蹲守"Max级开源首次落地"
阿里此前承诺将在8月10日当周于Hugging Face和ModelScope发布Qwen3.8-Max(2.4万亿总参数、约950亿激活参数、百万级上下文)及新款Qwen3.8-27B的开源权重,这将是Qwen系列首次在"Max"档位开放权重。截至发稿权重尚未上线,X上开发者持续蹲守,讨论焦点集中在协议类型是否商用友好,以及能否复刻此前Qwen3.8-Max发布时"直接对标Claude"的热度。
大模型与前沿技术
媒体报道 阿里Qwen3.8-Max/27B开源权重本周落地 — 首次在"Max"参数量级开放权重,将登陆Hugging Face与ModelScope。SCMP
官方发布 OpenAI联合AWS、Cursor、GitHub、微软、Vercel发布Agent Plugins 1.0开放标准 — 统一智能体技能与MCP配置的打包格式,Codex、ChatGPT、Cursor、GitHub Copilot等首批兼容,技术指导委员会由五方共同组成、无单一公司主导路线图。AWS开源博客
媒体报道 MiniMax开源全模态模型H3 — 提供ComfyUI首日适配,延续国内厂商在开源多模态赛道的密集布局。AIapps月报
商业与投资
官方发布 核微反应堆初创Valar Atomics获红杉领投10亿美元B轮 — 用于量产为AI数据中心供电的氦冷五兆瓦反应堆Ward 250,公司估值升至60亿美元。Bloomberg
媒体报道 制造业机器人初创Hadrian完成13.7亿美元D轮 — 估值五倍跳升至78.7亿美元,资金用于新建工厂、扩大研发及国防航天零部件产能。Tectonic Defense
媒体报道 AI基础设施连接平台Lumilens出隐身模式,融资超7亿美元 — 与Hadrian、Base Power、Valar Atomics同期,共同构成本周"十亿美元级"融资潮的一部分。Crunchbase News
政策与治理
官方发布 白宫向五大AI/芯片巨头通报前沿模型网络安全自愿测试框架 — Anthropic、OpenAI、谷歌、Meta、英伟达获吹风简报,框架允许政府在模型发布前最长30天进行早期评估,是否参与仍为自愿性质。CNBC
官方发布 美国能源部启动"Genesis开源模型计划" — 联合Arcee AI打造首个模型Genesis-Science-1,面向材料科学、核聚变、地球系统建模等领域,8月14日截止首轮贡献者申请。美国能源部
媒体报道 欧盟AI法案高风险与透明度条款持续强制执行中 — 8月2日起,8家训练算力超10^25 FLOPs的基础模型厂商须按月提交系统性风险评估报告。Cubbbix
产品与应用
官方发布 ChatGPT免费用户无限文字对话本周全量上线 — 默认切换至GPT-5.6 Luna模型,取消原每5小时10条消息上限,新增"Think"深度推理按钮。TechCrunch
媒体报道 Command Code推出GOAT订阅方案 — 单一订阅打包超30款编程模型,加入本周编程类AI工具竞争。This Week in All Things AI
媒体报道 Zocks上线AI自动会议预约功能Zocks Scheduling — 通过分析对话与邮件内容自动识别会议信息并直接完成预约排程,面向金融顾问等专业服务场景。PLANADVISER
深度视角
当"Critical"从理论走进现实:AI安全评估体系迎来第一次真正的压力测试
过去两年,各大AI实验室相继建立起类似OpenAI《预备框架》、Anthropic《负责任扩展政策》这样的分级安全评估体系,但这些框架里"Critical"这类最高风险档位,长期以来更像是纸面上的理论上限——直到这周,OpenAI第一次公开承认自家未发布模型Astra"不能排除"已经触及这一门槛。这不是一次产品发布会,而是一次风险披露,其意义恰恰在于它把"AI可能自主完成端到端网络攻击"从行业内部的沙盘推演,第一次变成了有具体模型代号、具体日期、具体应对措施的现实事件。
值得注意的是,这条新闻和当周另外两条政策新闻构成了一个完整的叙事闭环:白宫此前已经向Anthropic、OpenAI、谷歌、Meta、英伟达吹风了一套自愿性的前沿模型网络安全测试框架,允许政府在模型发布前介入评估长达30天;而Astra事件几乎是这套框架"为什么需要存在"的第一个现实注脚。当技术能力的迭代速度持续超过大多数机构的想象,评估体系能否真正跟上——不只是写在纸面上的分级标准,而是当某个实验室真的按下"暂停键"时,整个生态系统(监管者、竞争对手、安全社区、普通用户)能否做出恰当反应——将成为检验这轮"自愿框架"是否有效的第一块试金石。
与此同时,商业与开源两条战线并未因为这条安全新闻而放缓:阿里正卡着这一周把2.4万亿参数的Qwen3.8-Max权重开放出来,五家AI与云厂商刚刚联手推出Agent Plugins标准试图统一智能体生态的"基础设施层",资本还在向核能、机器人这些为AI供电供料的重资产赛道砸下十亿美元级支票。这提醒我们,即便"Critical"级风险第一次被摆上台面,整个行业的扩张节奏并未因此踩下刹车——安全披露与能力竞赛,正在同一时间线上并行推进,谁也没有等谁。
本页内容基于公开报道与社区讨论整理,标注来源以供查证;「社区传闻」类信息未经官方证实,请注意甄别。© AI每日快报