H3 Max API 价格降下来了,租 GPU 跑 H3 得重算这笔账
·约 8 分钟阅读
你刚把 H3 的环境装好,模型下完,显卡终于开始干活。转头一看,云端又出了 H3 Max:一条 5 秒、1080p 的视频,当前公开 API 报价折算下来约 1.45 元。这时候再看自己的 GPU 账单,心里多少会咯噔一下。
先别急着关机。这个价格有截止日期,H3 Max 也不是把你下载的原版 H3 换了个名字。真正值得算的,是你花出去的那笔租机钱,还能换回什么。这次我们把 fal 的公开收费表和 ComputeUnion 的 B300 报价放到一起,看看成本门槛到底在哪儿。
核查日期:2026-09-09。中文按本站展示汇率 1 美元 = 7.25 元换算,不代表平台以人民币结算。本文没有调用付费生成接口;性能与榜单数据分别标注来源。
先把 1.45 元这笔账摊开
fal 的 H3 Max 接口页按输出视频的秒数收费,分辨率决定费率。不是每发一个请求就收这个数,也不是整个项目只要这个数。
| H3 Max 分辨率 | 首发价 / 视频秒 | 生成 5 秒 | 9 月 15 日起公布的 5 秒标准价 |
|---|---|---|---|
| 480p | 约 ¥0.0906 | 约 ¥0.45 | 约 ¥1.81 |
| 768p | ¥0.145 | 约 ¥0.73 | ¥2.90 |
| 1080p | ¥0.29 | ¥1.45 | ¥5.80 |
这张表只对应 H3 Max,不混入更便宜的 Turbo。首发优惠截至 2026 年 9 月 14 日;5 秒费用用未四舍五入的秒价计算。渠道如果临时调整活动,以H3 Max 当前报价页和最终结算为准,别把文章里的活动价记成永久价。
1.45 元买的是一次生成,不是一个一定能交付的镜头。假设你做五次只留下一次,实际消耗就是 7.25 元。这个例子不是我们测得的出片率,只是在提醒:做视频的人最后交的是片子,不是请求成功的截图。
它值得试,但榜单第一不等于你的第一条片就能用
9 月 9 日查看 Artificial Analysis 带音频图生视频榜,H3 Max 位于第 1 名,Elo 1200,5,617 个样本,95% 区间约为 ±9。这个成绩说明它在该榜单的盲测里很受欢迎,不等于所有视频任务第一,也不等于它比第二名稳定高出一个档次。
我更在意三个很具体的镜头:同一个人转身后脸有没有换掉,手拿商品时包装上的字有没有乱掉,一句台词有没有在应该停下的地方停住。找一组你真的会交给客户的素材去试,比连续看十个精挑细选的宣传片更有用。
fal 公布了后训练、首尾帧控制和原生音画生成等产品说明,见官方产品页。这些是选择测试任务的依据,不是 ComputeUnion 做过的实测承诺。
你租到的是 B300,不是 fal 的整套 H3 Max 服务
这里最容易产生误会:H3 Max 是 fal 基于 MiniMax H3 后训练并结合其推理服务提供的产品。原版开放权重可以走自己的部署路线,但租几张显卡,不代表就能复刻 H3 Max 的模型效果、服务延迟和运营成本。
所以原来的 H3 本地部署文章仍然有用:它解决显存、主机内存、卸载和运行路线的问题。这一篇不再重复装环境,而是回答装完以后值不值得继续养着机器。原版 H3 的模型页也会保留,两者不合并、不共用一份价格。
按本站 B300 报价,自部署要跨过这条线
9 月 9 日读取本站 B300 租赁页,7 家渠道的记录单价约为每 GPU 每小时 36.18—62.93 元,最低记录来自 Prime Intellect,原币价为每 GPU 每小时 4.99 美元。它是单卡口径的报价,不保证能够按同一单价订到四卡、同机互联和所需主机内存的实例。
先拿这个最低记录做一个对自部署很有利的成本下限:假定四张 B300 都能按相同单价租到,机器一直有活干,不计初始化、存储、网络和失败重试。四卡一小时就是约 144.71 元。
| 比较对象:5 秒 1080p | API 费用 | 四卡租金打平所允许的生成时间 |
|---|---|---|
| H3 Max 首发活动价 | ¥1.45 | 约 36 秒 / 条 |
| 公布的活动后标准价 | ¥5.80 | 约 144 秒 / 条 |
算法就是:API 单条费用 ÷ 四卡小时租金 × 3600。36 秒和 144 秒是成本门槛,不是我们测出来的 H3 速度。原版 H3 必须在你接受的同样画质与时长条件下测运行时间;两个模型的效果不相同,这张表更不能当作同质量跑分。
如果机器只有一半计费时间在生成,门槛还要减半,约 18 秒和 72 秒。租金照收,队列空着的时间不会消失。再加上失败重跑、环境维护和实际整机报价,自部署的空间通常只会更窄。反过来,已经有机器、稳定排满队列、需要改模型的人,算出来也可能是另一笔账。
今天只想把活交掉,和准备长期做服务,不是一种买法
临时接到一组商品短片,我会先用 API 跑小批量素材,尤其在首发活动还在的时候。先盯角色、商品和动作是否合格,满意再扩大。不要先充值一大笔,再去找自己为什么需要它。
如果你的任务是改权重、改推理流程,或者素材处理有明确的本地化要求,自部署的价值就不只是那几元钱。但这些需求也意味着有人要维护环境。GPU 比价能帮你找报价,不能替你把工程时间从账单里抹掉。
准备做AI 短剧,也别一上来就把一整集都生成完。先锁定角色和关键镜头,把合格的片段留下;制作成本页接着看镜头、重试和后期,而不是凭空猜一个月会花多少钱。
这次最值得记录的,是哪一条真的被你留下来了
留一张小表就够:模型版本、分辨率、时长、付费次数、最终保留的片段、总费用。API 和本地各跑同一组素材,合格标准由你定。等这张表填完,再决定要不要继续租机。
便宜的 API 不是在宣判 GPU 没价值,它只是抬高了“为了省钱而自部署”的门槛。能控制什么、能改什么、任务是不是排得满,才是下一笔钱该不该花的理由。上面的租金是当日观察值;准备下单时,重新打开H3 Max 报价和B300 当前价格,别拿过期活动和另一家的机器配置做比较。
价格采集与来源状态见数据方法。本文将平台公开价、第三方榜单和本站市场观察分开,计算示例不代表生成质量测试、实时库存保证或投资回报承诺。