2026年7月9日 · 星期四 · 第 1 期(早间版)

Grok 4.5 打响推理价格战

覆盖过去24小时 X 平台热议与主流媒体报道 · 每日 08:00 更新

今日头条

热度最高官方发布

xAI 发布 Grok 4.5:Musk 称"Opus 级",价格仅为对手四分之一

xAI 于7月8日发布 Grok 4.5,主打编程、agentic 任务与知识工作,7月9日面向公众开放。Musk 称其能力"大致相当于 Opus 4.7 但快得多"。定价 $2/百万输入、$6/百万输出,而 Opus 4.7 为 $5/$25。模型在数万块 NVIDIA GB300 GPU 上训练,与 Cursor 合作训练编程能力。欧盟区暂不可用,预计7月中旬上线。

为什么重要:这是 xAI 上市后的首个模型,也是frontier厂商第一次把"旗舰级"能力压到 $2/$6 的价格带——恰逢 Anthropic 将 Fable 5 转为高价计费($10/$50)的同一天,两家路线形成鲜明对照。若 Grok 4.5 实测接近 Opus 级,将对 Anthropic 和 OpenAI 的定价体系构成直接压力。后续看点:独立 benchmark 复测、EU上线时间、以及"Opus-class"说法在X上的验证之战。
来源:xAI 官方 · TechCrunch · Axios

X 热议榜

趋势卡

1 · Paul Graham 的"2031思想实验"持续发酵

"想象5年后的模型对 Fable 的提升,等于 Fable 对 GPT-3 的提升。"这条7月7日的帖子登上趋势卡后仍在刷屏:乐观派畅想"无法理解的能力",怀疑派认为 scaling 已放缓,还有大量用户借机吐槽每天 $200–500 的 token 开销——"先把 Fable 降价再谈2031"。

争论中

2 · "Opus-class"之争:Grok 4.5 到底几斤几两

Musk 的"Opus 级"定位立即引发 benchmark 党与实测党混战。支持者晒出编程 agent 实测速度,质疑者指出官方未公布完整对比数据、且 EU 不可用意味着监管合规仍是短板。这是发布24小时内 X 上最大的技术争论。

来源:TechCrunch · ExplainX
隐私争议

3 · Fable 5 收费 + 实名验证,用户情绪两极

7月8日起 Fable 5 对所有 Claude 用户按量计费($10/$50 每百万token),且访问 Fable 5/Mythos 5 需政府证件+活体自拍验证。X 上一边是"最强模型值这个价",另一边是对生物识别验证的强烈隐私反弹。

数据热帖

4 · "美企一半 token 跑在中国模型上"引爆讨论

CNBC 报道美国企业 30–46% 的 AI token 用量流向中国模型;GLM-5.2 上线首周 token 量涨约27倍、客户数涨约80倍,SWE-bench Pro 62.1% 超过 GPT-5.5(58.6%)。"中国是否已追平"成为 X 上持续整周的辩题。

体验刷屏

5 · GPT-Live 语音体验帖刷屏:"它会嗯哼附和"

OpenAI 全双工语音模型 GPT-Live 全球推送后,大量用户晒对话录音:能边听边说、会"mhmm"附和、你思考时会安静等待。"最接近打电话的AI"成为高赞评价,也有人担心情感依赖问题。

大模型与前沿技术

商业与投资

政策与治理

产品与应用

深度视角

价格战开启:中美模型竞争进入第二阶段

过去48小时的三条新闻放在一起看,勾勒出行业的新格局:Anthropic 把 Fable 5 定价 $10/$50 走"最强能力高溢价"路线;xAI 用 $2/$6 的 Grok 4.5 宣称"Opus 级但便宜75%";而 GLM-5.2 以更低的价格拿下美企 30–46% 的企业 token 份额。

第一阶段的竞争比的是"谁的模型最强",第二阶段比的是"每美元智能"。当二线模型与顶级模型的差距缩小到多数任务无感时,价格弹性开始主导企业采购——GLM-5.2 一周27倍的 token 增长就是证据。这也解释了为什么 Paul Graham 的2031思想实验下,最高赞的回复不是畅想未来,而是"先把现在的模型降价"。

对 Anthropic 和 OpenAI 而言,真正的风险不是被追平,而是"够用且便宜"的替代品吃掉利润基本盘,压缩其支撑巨额训练投入的现金流——H1 两家吸走43%的全球创投资金,这个循环依赖高定价维持。值得跟踪的信号:Grok 4.5 独立评测结果、8月1日联合国前沿模型认定框架(可能改变各家的合规成本),以及 Fable 5 是否被迫调价。