技术背景:从 Colossus 1 到 Colossus 2 的 19 天奇迹

2024 年,xAI 在田纳西州孟菲斯把一座旧工业厂房改造成 AI 训练基地,这就是 Colossus 的起点。当时 NVIDIA CEO 黄仁勋用「超人」形容其交付速度——从选址到首批 GPU 上线,只用 19 天,而传统数据中心建设周期动辄 2-3 年。秘诀不是赶工,而是「绕开电网」:xAI 在园区里自建燃气发电,避开 ERCOT 式的并网排队,把电力、冷却、网络三层基础设施全部垂直整合。

Colossus 1 已经容纳 230,000 颗 GPU(其中 30,000 颗 GB200),耗电约 500 MW。Colossus 2 在此基础上直接翻倍:55 万颗 GB200/GB300,总功率冲到 1 GW。两者相加,孟菲斯园区已经是全球最大的单点 AI 训练设施。

核心事件:MACROHARDRR 把总功率顶到 2 GW

2025 年 12 月 30 日,马斯克在 X 上确认 xAI 买下密西西比州 Southaven 的第三栋建筑,代号 MACROHARDRR(延续他对微软的「Macrohard」命名梗)。这栋楼紧邻 Colossus 2,允许 xAI 用超低延迟网络把三处设施连成一个统一计算环境。

新园区数据如下:

  • 总 GPU 规模:约 555,000 颗,采购成本约 180 亿美元(平均每颗约 32,400 美元)
  • 总功率:~2 GW,等效于 150 万户美国家庭的用电量
  • GPU 构成:GB200 约 52 万颗 + GB300 约 3 万颗 + 早期 H100/H200 约 3 万颗
  • 冷却:液冷强制散热,需要每分钟 50,000+ 加仑冷却水(密西西比河流域供水)

横向对比一下,这个体量是 Meta AI 研究中心(500 MW)的 4 倍,Microsoft Azure AI(400 MW)的 5 倍。Musk 公开说过 xAI 的目标是「拥有比所有人都多的 AI 算力」——现在他在单点上做到了。

Grok 4.6 / 4.7:用算力换迭代速度

这套堆栈不是摆设,而是直接服务于 xAI 的模型节奏。Musk 7 月 18 日在 X 上确认 Grok 4.6 进入发布管线,7 月 24 日进一步给出硬时间表:4.6 两周内、4.7 再两周后,两个万亿参数模型在 4 周内连发。

具体规格:

  • Grok 4.6:1.5 万亿参数,V9 基座,主打 SFT + RL 升级,预计 8 月 7 日上线
  • Grok 4.7:2.1 万亿参数,Musk 自称「每个维度都比 4.6 强,只是推理稍慢」

对比一下,GPT-3 是 1750 亿参数——xAI 现在单模型已经是它的 10 倍以上。而 Grok 4.5 已经在 SWE Marathon 编程基准上拿到 29.0%,领先 Claude Opus 4.8 的 26.0%。Colossus 2 提供的不只是「更大的模型」,而是「更频繁的训练-评估-发布」闭环:Musk 之前透露 xAI 维持每周两次的模型更新频率,2 GW 算力是支撑这种节奏的物理底座。

行业影响:算力即护城河

xAI 的玩法给整个前沿 AI 实验室划了一条新的基线:在 OpenAI、Anthropic、Google 都还在 1 GW 量级时,xAI 已经把单点算力顶到 2 GW。这不只是一个数字游戏——更快的训练循环意味着可以同时跑多个实验候选、可以承受 RL 微调更高的失败成本、可以在更长上下文 / 更大 MoE 上做更激进的尝试。

但代价同样显眼。Colossus 自建燃气电厂的模式在田纳西/密西西比引发电网压力和环保争议,「AI 工厂」对当地水资源和电费的冲击已经不是隐忧。如果 4.6/4.7 的发布真能兑现「更便宜、Opus 级」的承诺,xAI 的算力赌注就赢了;如果性能不及预期,180 亿美元的 GPU 库存就会变成全行业最贵的固定资产。

所以呢

短期看,Grok 4.6/4.7 是 xAI 对「参数即能力」路线的最新验证——V9 基座 + 1.5T/2.1T 参数 + 升级 RL,配合 2 GW 训练底座,这是 2025 年下半年最激进的 frontier 模型冲刺。长期看,这场算力军备竞赛正在重新定义「头部实验室」的入场券:没有 100 万颗 GPU 级别的训练设施,就别想在前沿模型榜上保持位置。Musk 已经把门槛抬到了 555,000 颗,下一步,看 OpenAI 和 Anthropic 怎么接。