H3 Max API 价格降下来了,租 GPU 跑 H3 得重算这笔账

·约 8 分钟阅读

你刚把 H3 的环境装好,模型下完,显卡终于开始干活。转头一看,云端又出了 H3 Max:一条 5 秒、1080p 的视频,当前公开 API 报价折算下来约 1.45 元。这时候再看自己的 GPU 账单,心里多少会咯噔一下。

先别急着关机。这个价格有截止日期,H3 Max 也不是把你下载的原版 H3 换了个名字。真正值得算的,是你花出去的那笔租机钱,还能换回什么。这次我们把 fal 的公开收费表和 ComputeUnion 的 B300 报价放到一起,看看成本门槛到底在哪儿。

核查日期:2026-09-09。中文按本站展示汇率 1 美元 = 7.25 元换算,不代表平台以人民币结算。本文没有调用付费生成接口;性能与榜单数据分别标注来源。

先把 1.45 元这笔账摊开

fal 的 H3 Max 接口页输出视频的秒数收费,分辨率决定费率。不是每发一个请求就收这个数,也不是整个项目只要这个数。

H3 Max 分辨率首发价 / 视频秒生成 5 秒9 月 15 日起公布的 5 秒标准价
480p约 ¥0.0906约 ¥0.45约 ¥1.81
768p¥0.145约 ¥0.73¥2.90
1080p¥0.29¥1.45¥5.80

这张表只对应 H3 Max,不混入更便宜的 Turbo。首发优惠截至 2026 年 9 月 14 日;5 秒费用用未四舍五入的秒价计算。渠道如果临时调整活动,以H3 Max 当前报价页和最终结算为准,别把文章里的活动价记成永久价。

1.45 元买的是一次生成,不是一个一定能交付的镜头。假设你做五次只留下一次,实际消耗就是 7.25 元。这个例子不是我们测得的出片率,只是在提醒:做视频的人最后交的是片子,不是请求成功的截图。

它值得试,但榜单第一不等于你的第一条片就能用

9 月 9 日查看 Artificial Analysis 带音频图生视频榜,H3 Max 位于第 1 名,Elo 1200,5,617 个样本,95% 区间约为 ±9。这个成绩说明它在该榜单的盲测里很受欢迎,不等于所有视频任务第一,也不等于它比第二名稳定高出一个档次。

我更在意三个很具体的镜头:同一个人转身后脸有没有换掉,手拿商品时包装上的字有没有乱掉,一句台词有没有在应该停下的地方停住。找一组你真的会交给客户的素材去试,比连续看十个精挑细选的宣传片更有用。

fal 公布了后训练、首尾帧控制和原生音画生成等产品说明,见官方产品页。这些是选择测试任务的依据,不是 ComputeUnion 做过的实测承诺。

你租到的是 B300,不是 fal 的整套 H3 Max 服务

这里最容易产生误会:H3 Max 是 fal 基于 MiniMax H3 后训练并结合其推理服务提供的产品。原版开放权重可以走自己的部署路线,但租几张显卡,不代表就能复刻 H3 Max 的模型效果、服务延迟和运营成本。

所以原来的 H3 本地部署文章仍然有用:它解决显存、主机内存、卸载和运行路线的问题。这一篇不再重复装环境,而是回答装完以后值不值得继续养着机器。原版 H3 的模型页也会保留,两者不合并、不共用一份价格。

按本站 B300 报价,自部署要跨过这条线

9 月 9 日读取本站 B300 租赁页,7 家渠道的记录单价约为每 GPU 每小时 36.18—62.93 元,最低记录来自 Prime Intellect,原币价为每 GPU 每小时 4.99 美元。它是单卡口径的报价,不保证能够按同一单价订到四卡、同机互联和所需主机内存的实例。

先拿这个最低记录做一个对自部署很有利的成本下限:假定四张 B300 都能按相同单价租到,机器一直有活干,不计初始化、存储、网络和失败重试。四卡一小时就是约 144.71 元

比较对象:5 秒 1080pAPI 费用四卡租金打平所允许的生成时间
H3 Max 首发活动价¥1.45约 36 秒 / 条
公布的活动后标准价¥5.80约 144 秒 / 条

算法就是:API 单条费用 ÷ 四卡小时租金 × 3600。36 秒和 144 秒是成本门槛,不是我们测出来的 H3 速度。原版 H3 必须在你接受的同样画质与时长条件下测运行时间;两个模型的效果不相同,这张表更不能当作同质量跑分。

如果机器只有一半计费时间在生成,门槛还要减半,约 18 秒和 72 秒。租金照收,队列空着的时间不会消失。再加上失败重跑、环境维护和实际整机报价,自部署的空间通常只会更窄。反过来,已经有机器、稳定排满队列、需要改模型的人,算出来也可能是另一笔账。

今天只想把活交掉,和准备长期做服务,不是一种买法

临时接到一组商品短片,我会先用 API 跑小批量素材,尤其在首发活动还在的时候。先盯角色、商品和动作是否合格,满意再扩大。不要先充值一大笔,再去找自己为什么需要它。

如果你的任务是改权重、改推理流程,或者素材处理有明确的本地化要求,自部署的价值就不只是那几元钱。但这些需求也意味着有人要维护环境。GPU 比价能帮你找报价,不能替你把工程时间从账单里抹掉。

准备做AI 短剧,也别一上来就把一整集都生成完。先锁定角色和关键镜头,把合格的片段留下;制作成本页接着看镜头、重试和后期,而不是凭空猜一个月会花多少钱。

这次最值得记录的,是哪一条真的被你留下来了

留一张小表就够:模型版本、分辨率、时长、付费次数、最终保留的片段、总费用。API 和本地各跑同一组素材,合格标准由你定。等这张表填完,再决定要不要继续租机。

便宜的 API 不是在宣判 GPU 没价值,它只是抬高了“为了省钱而自部署”的门槛。能控制什么、能改什么、任务是不是排得满,才是下一笔钱该不该花的理由。上面的租金是当日观察值;准备下单时,重新打开H3 Max 报价B300 当前价格,别拿过期活动和另一家的机器配置做比较。

价格采集与来源状态见数据方法。本文将平台公开价、第三方榜单和本站市场观察分开,计算示例不代表生成质量测试、实时库存保证或投资回报承诺。

相关链接

← 返回博客