AI Infra 正在诞生自己的石油期货?GPU 不够买之后,华尔街开始交易算力
点击查看原文>

本条来自 InfoQ 中文(AI / 工程),聚焦 technology、company。 AI摘要 CFTC 正式就算力衍生品监管征求意见,标志 AI 算力正从稀缺资源转向可定价、可对冲的金融资产;CME 与 Silicon Data 已启动基于 H100/B200 租赁价格的期货产品开发。
点击查看原文>
- GPU × 网络 × 集群规模 × 可用率 × 软件栈 × 地理位置 × 时间
- 这意味着 AI 算力首先必须解决一个金融市场最基本的问题: 如何标准化?
- 这三层其实对应着 AI 产业正在形成的一条新的经济链条:
- GPU / Compute → Token → Agent Task
- AI摘要 CFTC 正式就算力衍生品监管征求意见,标志 AI 算力正从稀缺资源转向可定价、可对冲的金融资产;CME 与 Silicon Data 已启动基于 H100/B200 租赁价格的期货产品开发
点击查看原文>
AI摘要 CFTC 正式就算力衍生品监管征求意见,标志 AI 算力正从稀缺资源转向可定价、可对冲的金融资产;CME 与 Silicon Data 已启动基于 H100/B200 租赁价格的期货产品开发。
算力衍生品监管框架进入实质推进阶段;H100/B200 租赁价将成为首批标准化期货标的;金融资本深度介入算力基建,凸显其资产属性强化。
适合AI基础设施工程师、云平台架构师、量化交易系统开发者阅读。
AI 行业可能很快就要面对一个过去听起来有些荒诞的问题: 半年后的 H100 算力值多少钱?
过去两年,围绕 GPU 的讨论大多集中在“够不够用”:大模型公司抢 GPU,云厂商扩数据中心,创业公司排队租算力,资本市场则不断计算 NVIDIA 还能卖出多少张卡。但现在,问题开始从“有没有 GPU”,转向“GPU 算力应该值多少钱,以及如何提前锁定这个价格”。
2026 年 8 月,美国商品期货交易委员会(CFTC)正式就 compute derivatives(算力衍生品) 公开 征求意见 ,讨论现货算力市场、市场操纵、客户保护以及 perpetual compute futures(永续算力期货) 等问题。CFTC 主席 Michael Selig 更直接表示,美国如果希望在 AI 竞争中保持领先,就需要一个健全的算力衍生品市场。
这并不是监管机构凭空设想出来的新金融产品。就在此前,CME Group 与 AI 算力市场基础设施公司 Silicon Data 已经 宣布 ,计划推出以 NVIDIA H100 和 B200 GPU 租赁价格为基础的期货产品。Silicon Data 刚刚完成 3050 万美元 A 轮融资,投资方中不仅有传统 VC,还出现了 CME Ventures、DRW、Samsung Next、VanEck、Jump Trading 等明显具有金融市场背景的机构。
GPU → 算力商品 → 价格指数 → 期货合约 → 金融资产。
AI Infra 的下一场战争,可能已经不只发生在芯片、网络和数据中心之间。华尔街正在进入机房。
今天一家 AI 公司采购算力,大致有几种选择。财力足够雄厚的公司,可以直接购买 GPU,自己建设集群;规模稍小一些的企业,可以向 AWS、Azure、Google Cloud 等云厂商购买实例;还有越来越多公司从 CoreWeave 等 GPU Cloud 或算力市场购买短期、长期租赁服务。
无论选择哪一种方式,企业都会面临一个共同问题: 未来的算力价格是不确定的。
假设一家 AI 创业公司预计未来一年需要持续训练和运行模型,那么 GPU 成本可能成为其最大的成本项之一。公司可以今天签下一份长期算力合同,但这意味着它必须承担预测错误的风险。如果未来 GPU 供给突然宽松,价格大幅下降,它可能买贵了;反过来,如果模型调用量突然暴涨,或者新一轮大模型竞争再次制造 GPU 短缺,它又可能发现自己提前锁定的算力远远不够。
这和航空公司面临的燃油问题其实非常相似。航空公司知道未来一定需要燃油,却不知道半年后的油价,因此成熟的航空公司会通过期货、期权等金融工具提前锁定一部分成本。现在,有人希望把同样的机制搬到 AI 算力市场。
CME 与 Silicon Data 计划推出的产品,本质上就是让市场参与者可以提前交易未来某个时间点的 GPU 算力价格。企业甚至不需要通过期货市场真正获得一张 H100,就像航空公司交易石油期货,并不意味着最终需要把几万桶石油运到总部一样。AI 公司真正需要解决的是算力价格波动带来的经营风险。
如果企业预计半年后需要大量 B200,而担心届时算力价格上涨,就可以提前建立相应的期货头寸。即便未来实际算力采购成本提高,期货市场获得的收益也可以抵消其中一部分上涨。反过来,拥有大量 GPU 资产的云厂商、数据中心运营商,也可以通过衍生品降低未来算力价格下跌带来的风险。
于是,GPU 算力第一次真正拥有了成为可标准化交易商品的可能。而市场已经开始尝试回答文章开头的那个问题:未来的 H100 到底值多少钱?
Silicon Data 发布的 GPU 远期价格曲线 最长已经覆盖未来 36 个月。以 2026 年 7 月 19 日的数据为例,H100 的现货租赁价格约为每 GPU·小时 2.72 美元,36 个月期限价格约为 2.38 美元;B200 则从约 5.62 美元降至 5.17 美元,A100 从约 1.65 美元降至 1.40 美元。三种 GPU 的远期价格均低于当时的现货价格,这与市场对未来供应扩大、新一代芯片逐步替代旧型号的预期一致。换句话说,市场已经开始用一条真实的价格曲线,表达对“三年后的 H100 值多少钱”的判断。
这里还有一个问题有待解决,一桶布伦特原油和另一桶符合标准的布伦特原油,理论上具有很强的可替代性,但“一小时 H100 算力”到底是什么?
同样是一张 H100,放在不同的数据中心里,实际价值可能完全不同。它可能通过 NVLink 与另外七张 GPU 组成节点,也可能只是单卡实例;背后可能是高速 InfiniBand 网络,也可能是普通以太网;数据中心可能位于美国,也可能位于欧洲或亚洲;实例的可用率、存储性能、CPU 配置和软件环境同样存在差异。
对于大模型训练而言,这些差异尤其关键。企业购买的一小时 H100,实际上包含了一整套系统能力:
GPU × 网络 × 集群规模 × 可用率 × 软件栈 × 地理位置 × 时间
这意味着 AI 算力首先必须解决一个金融市场最基本的问题: 如何标准化?
没有标准化,就很难形成价格指数;没有价格指数,也很难建立真正具有流动性的期货市场。这也是 Silicon Data 这样的公司值得关注的原因。它没有直接进入 GPU 云市场与 AWS、CoreWeave 争夺算力客户,而是试图建立一层更底层的市场基础设施:收集不同算力市场中的 GPU 租赁价格,形成能够被金融市场接受的 benchmark。
它想扮演的角色,更接近 AI 算力市场里的 Platts、Argus,甚至 Bloomberg 。谁能够定义市场价格,谁就可能成为未来大量金融产品的基础设施。
过去几年 GPU 市场一个非常特殊的现象也在强化这种需求: 价格极度不透明。 云厂商有自己的价格体系,GPU Cloud 有自己的长期合同,算力经纪商还有另外一套报价。同一型号 GPU,因为合同周期、地区、集群规模和客户议价能力不同,最终成交价格可能存在明显差异,大量交易甚至根本没有公开市场价格。
这在一个快速扩张的行业早期并不奇怪。石油、电力、航运、利率甚至碳排放市场,都经历过类似的过程:最开始是大量双边交易,随后出现标准合同,再后来出现价格指数,最后才形成具有流动性的金融衍生品市场。AI 算力今天可能正在走到第三步。
而一旦形成可信的 GPU 价格指数,它带来的变化就远远超过“可以炒 GPU 期货”。一家准备建设大型 GPU 数据中心的公司,可以根据未来算力价格曲线判断项目回报;银行可以基于未来算力收入提供贷款;GPU Cloud 可以对冲算力价格下跌;AI 公司可以锁定未来推理成本;投资机构则可以直接交易对 AI 算力供需的判断。
甚至数据中心项目融资的逻辑也可能随之变化。过去银行判断一个数据中心项目是否值得贷款,需要重点评估客户合同、资产价值和运营能力。如果未来存在一个足够成熟的 GPU 算力期货市场,金融机构就第一次拥有了一个公开、实时变化的“未来算力价格”,相当于给 AI 基础设施增加了一套资本市场能够理解的定价语言。
GPU 金融化还会迫使市场回答一个长期被硬件型号掩盖的问题: 我们到底应该如何衡量 AI 算力?
过去行业最简单的评价方式是看 GPU 型号和数量:1000 张 H100、10000 张 B200、10 万张 GPU 集群。但真正运营过大模型集群的人都知道,“拥有多少 GPU”和“获得多少有效算力”之间存在巨大差距。GPU 利用率、MFU、网络通信效率、故障率、任务调度、模型并行策略都会影响最终产出。一万张 GPU 如果只有 40% 的有效利用率,和另一套拥有更少 GPU、但能够长期维持 70% 利用率的集群,经济价值显然完全不同。
于是,一个有意思的问题出现了:如果未来算力真的成为一种标准化商品, 市场最终应该交易“GPU 使用时长”,还是经过利用率、通信效率等因素折算后的“有效算力”?
至少现阶段,金融市场选择了更容易标准化的前者。目前正在设计中的 GPU 算力期货并没有试图创造一个横跨不同芯片的统一“标准算力单位”,而是按照具体 GPU 型号分别设计合约:H100、B200、A100 被视为性能和价格不同的产品,以每 GPU·小时作为基础计价单位,H100 和 B200 的合约也分别交易。
这解决了金融交易中的标准化问题,却没有完全解决工程世界里的算力衡量问题。两套同样拥有 1000 张 H100 的集群,如果网络互联、GPU 利用率、故障率和软件栈完全不同,最终能够提供的有效算力显然也不同。Silicon Data 自己在建立价格指数时,也需要对 GPU 型号、内存和 CPU 配置、租赁期限、互联和集群规模、数据中心区域等变量进行标准化处理。
对企业而言,GPU 本身通常只是生产过程中的一个中间变量。训练一个模型需要多少钱?生成一百万 Token 需要多少钱?完成一个 Coding Agent 任务需要多少算力成本?这些指标可能比单纯的 GPU 数量更接近企业最终关心的问题。
这也意味着,AI 算力金融化可能反过来推动 AI Infra 的评价体系发生变化:行业长期习惯用 GPU 数量、峰值 FLOPS 等硬件指标衡量基础设施,但当算力真正进入成本核算和金融定价体系后, 单位业务产出对应的算力成本 会越来越重要。Token/元、有效算力、集群 Goodput、模型完成时间等指标,也会从工程团队内部的优化指标,逐渐进入企业经营层面的计算。
把最近一系列行业变化放在一起看,这个趋势更加明显。GPU 云公司正在通过长期算力合同获得融资,数据中心运营商围绕未来 AI 需求发行债务,GPU 被包装成能够产生持续现金流的基础设施资产,算力市场开始建立 GPU 现货价格体系。现在,CME 希望推出 GPU 算力期货,CFTC 则正式开始讨论算力衍生品应该如何监管。
AI Infra 正在重复很多传统基础设施行业走过的道路。当一种资源足够重要、投入足够大、价格波动足够明显之后,围绕它就会自然长出一套金融基础设施: 定价、指数、期货、保险、融资、套利和风险管理。 只不过这一次,被金融化的是 GPU 上的计算时间。
而且 GPU 很可能只是第一层。模型越来越多之后,企业还需要决定每一次请求应该发给 GPT、Claude、Gemini,还是更便宜的小模型;不同模型之间价格和性能不断变化,模型路由、Token 成本管理开始成为独立基础设施。底层解决 Compute 如何定价,中间层解决 Token 如何定价和路由,再往上则会出现另一个问题: 一个 AI Agent 完成一项任务到底值多少钱?
这三层其实对应着 AI 产业正在形成的一条新的经济链条:
GPU / Compute → Token → Agent Task
本条目归入「Technology AI」垂直,涉及真实话题:technology、company。
· 市场:关注 technology、company 对相关品类与竞争格局的潜在影响。
· 消费者:受众行为与偏好变化值得追踪。
· 品牌:本动向对品牌资产建设的启示。
· 渠道:内容分发与触点组合(社媒 / 电商 / 线下)的协同值得复盘。
· 核心话题:technology、company。
· 可思考:如何把「technology」的洞察,转化为可衡量的内容与增长动作?
面试中可引用「AI Infra 正在诞生自己的石油期货?GPU 不够买之后,华尔街开始交易算力」:围绕 technology、company,说明你对行业动向的判断与可落地动作。
本条目相关英文术语可在「商务英语」模块按话题检索,用于外企面试表达训练。
AI摘要 CFTC 正式就算力衍生品监管征求意见,标志 AI 算力正从稀缺资源转向可定价、可对冲的金融资产;CME 与 Silicon Data 已启动基于 H100/B200 租赁价格的期货产品开发。…