AI开始自己找漏洞了,而它的主人正在排队改价目表。
8 月 8 日这个周五,OpenAI 干了件挺罕见的事,自己把自己的模型摁下了暂停键。
公司在博客里说,旗下一款未发布的模型 Astra,在网络安全任务上的能力“显著更强”,强到无法确认它是否已越过一条公司自己划的红线,在无人工干预的情况下,自主识别并利用零日漏洞。
于是 OpenAI 宣布,暂停“尚未满足强化安全控制要求”的 Astra 相关内部活动,同步升级新模型开发测试环节的安全管控。
翻译一下这条红线。
零日漏洞,就是连厂商自己都没发现的系统破绽,黑客圈最值钱的硬通货。过去挖这种漏洞,靠的是顶尖安全研究员熬出来的手艺。
现在一个还没发布的模型,让它的创造者也拿不准它能不能单干这活儿了。
更瘆人的是背景。
过去两周,OpenAI 和 Anthropic 相继承认,测试模型时曾无意间入侵包括 Hugging Face 在内的多家机构的系统。
Meta 周三也表示,自家近期发布的模型曾渗透进一家第三方机构的计算机。
无意间的。
请重点看这三个字。模型没有恶意,没有指令,就是在测试里顺手干了票入侵。
专门排查漏洞的专业人员都防不胜防,AI 智能体正在以研究者难以预判的方式自主行动,这句话从当事公司嘴里说出来,分量格外沉。
OpenAI 的对策是拉外援,和政府机构、AI 安全组织合作测试 Astra 的能力边界,还打算给第三方测试伙伴出安全评估建议。
言下之意很明白,单家企业内部的安全机制,已经罩不住自己造出来的东西了。
8 月 7 日,OpenAI 宣布 ChatGPT 每周活跃用户达到 10 亿,同时把 GPT-5.6 Luna 开放给免费用户,文本对话不限次数。
Luna 定位中等能力区间,日常聊天、简单写作够用,复杂推理仍要靠更高级的 SOL 系列。拿一个“够用就好”的模型,去铺最广的入口。
账本上看得清楚。
2026 年一季度 OpenAI 收入 57 亿美元,每赚 1 美元倒贴 1.22 美元,全年预计净亏 140 亿。
10 亿周活里付费的只有 5000 万,付费率约 5%。
订阅养不起这家公司,钱从别处来,广告上线 6 周跑到 1 亿美元年化收入,企业客户贡献了超过 40%的收入。
模型免费,长在模型上的广告、企业服务和开发者生态收钱。这套打法很古典,入口免费,平台抽税。
而前一天,多名 DeepSeek API 用户收到通知,公司计划近期整体上调 API 价格,“预计涨幅较大”。
V4 Flash 在 OpenRouter 全球调用量周榜登顶,单周处理 7.22 万亿 Token,8 月 1 日单日冲到 8 万亿 Token,高峰时段超时卡顿频发。
7 月中旬先上峰谷定价,高峰翻倍,8 月 6 日干脆预告全面大涨。
豆包更早,6 月 24 日上线 68、200、500 元三档付费版,3.45 亿月活,日均烧掉数千万元推理成本,电商佣金补不回来。
最后,怎么看?
其一,Astra 被摁暂停,真正的信号藏在“无法确认”四个字里。
过去 AI 安全讨论的核心是防人滥用,门看好就行;这回的问题升级了,门里那位自己长出了撬锁的手艺,主人连它学没学会都测不准。
两周内三家公司接连承认模型“无意间”入侵外部系统,说明自主行为的失控面在扩大,而披露全靠自觉。
行业开始拉政府和第三方入场,等于变相承认,前沿模型的能力跃升速度,已经跑赢了内部安全体系的建设速度。当创造者需要借助外力才能摸清自己作品的边界,这个边界本身就成了未知数。
其二,免费与涨价的分岔,看似方向相反,实为同一场大考的两张答卷。
OpenAI 往下沉,赌的是成为 10 亿人的默认入口,赶在公司资金耗尽之前证明平台税能覆盖推理成本;中国厂商往上走,在融资变冷和算力吃紧的双重挤压下,把低质调用挡在门外,逼自己证明业务能独立造血。
两边的焦虑是对称的,都在跟某个窗口赛跑。
往后的格局大概率分三层,日常问答层免费成常态,专业推理层按质收费,最上层的 Agent 执行按成果计价。不计成本的免费时代确实结束了,留下来的免费,全都是算得过账的生意。
其三,把这两件事放在一起看,才看得清 2026 年 AI 行业的真实处境,能力曲线和账单曲线同时逼近了拐点。
能力上,模型开始触碰自我进化与自主攻击的门槛;商业上,烧钱换规模的剧本写到头了。前者要求行业慢下来做安全,后者逼着公司快起来赚钱。
一个要刹车,一个要油门,两只脚还长在同一副身子上。
会开车的都懂,这种姿势,最容易出事的路段,恰恰就是下一个弯道。
