GPU 秒级计费在哪里撞坏了刷卡通道
为什么不到一分钱的推理计费,在刷卡通道上要丢掉一截?
按秒计费的 GPU 定价,和为 50 美元电商客单设计的刷卡通道,有四处结构性错位。
每笔最低收费逼你合并计费,利润漏点被藏起来
一次 A100 推理,客户实际消耗可能不到两分钱。刷卡通道不收这么小的扣款,你只能按小时或按天合并成 5 到 20 美元的批量账单。每批都带一笔固定手续费加百分比,5 美元的批量账单可能被手续费吃掉约 9%。大推理平台都这么干、也都默默扛着——客户看到的是一笔说不清的「平台费」,你看到的是一笔说不清的「处理成本」。
预充值没花完不是白赚,是要挂账的负债
AI 平台的标准卖法是「充 50 美元点数,几个月慢慢烧」,其中相当一部分永远不会被用完。表面看是白拿的毛利,实际上你欠着客户:客户要求退款或合规政策触发时,你得退。那笔漂着的预收款是要记账、要最终归还的负债,不是意外之财。
AI 客户大多在海外,卡覆盖到处是缺口
做 ML 研究的人遍布全球——拉美、南亚、东南亚、中东、非洲。很多地区的发卡行对境外 SaaS 扣款的拒付率很高,客户还要再扛一层货币转换费和本地税。一个月愿意付 20 美元的客户,可能在第二次验证跳转时放弃整个流程。
企业「预付承诺、按量消耗」塞不进刷卡账单模型
大企业 PoC 预算的常见结构是「先承诺 50000 美元,12 个月按量扣」。刷卡计费的对象模型里没有余额台账,你只能在自己数据库里另记一本账,再跟处理商的用量对象对账。承诺消费的基础设施得自己造,因为对方承诺的「50000 美元承诺额」根本放不进标准计费对象里。
期末一次结算怎么贴合推理经济
用量变成一笔稳定币付款后,什么变了?
四个让 GPU 秒级计费回本的机制。
你计 GPU 秒数,Paymos 开汇总账单——没有最低收费
你的计量器按自己的节奏聚合 GPU 秒数、推理 token 或训练点数——按小时、按天、按周、按任务都行。你调用一次,Paymos 就开一张结算账单,金额随意:1.20、14.40、847 美元。没有每笔固定手续费、没有最低金额,账单是一美元还是五万美元,费率都一样。实时按秒计费,再小的调用也值得收。
预充值就是你库里的一条余额,退款就是一笔转账
客户预付 50 美元,款项进你的 Paymos 余额,你的数据库给客户点数加一笔。用量消耗时往下扣——没有外部余额对象要对账。客户弃用要求退款,或你的合规政策要求退还时,你从自己的 Paymos 余额发一笔转出。没有按笔的退款手续费,没有「原卡还有效吗」这种问题,链上流水还留下干净的记录。
哪个国家来付都一样,也不会因此被掐断
稳定币付款没有国家代码。从卡拉奇发来的转账和从山景城发来的,费率一样、确认时间一样,没有汇率加价、没有按国家拒付、没有叠在 20 美元订阅上的本地税。之前被二次验证挡住的拉美、中东、东南亚研究者终于能付款了——也没有处理商会因为你服务这些地区而冻结你的账户。
企业承诺额落地:一张账单、一个 webhook、你的点数台账
大额 PoC 先付 50000 美元承诺额,你开一张全额账单。结算后 Paymos 发出 HMAC-SHA256 webhook,你的处理程序给客户 GPU 预算入账,用量在你自己的台账里往下扣。不用账单计划变通,不用平行对账。客户签一次名,付款确认即 final,台账归你管,通道只是一个 webhook。
AI 平台怎么接入 Paymos
怎么把 Paymos 叠在你现有的用量计量上?
三条接入路径,按计费引擎深度和团队技术画像选。

嵌入式收银台——在控制台里充值
研究者打开你的控制台,点「充点数」,选 50 或 500 美元,嵌入式收银台在不离开你的域名的情况下完成付款。你现有的点数余额界面仍是唯一真相源,Paymos 只管收钱。适合跑交互式控制台、希望钱包步骤像原生体验而不是跳转出去的平台。
查看详情
Host-to-Host API——给自研计量器和承诺消费台账
如果你已经建了 Postgres 支撑的用量计量器(因为通用计量计费不够细),host-to-host API 让你按自己的节奏开账单,跨客户常用网络跟踪确认,用 HMAC-SHA256 webhook 标记计费周期关闭。你的调度器结账、调用 Paymos、客户钱包付款、应收自动对账——中间没有第三方订阅对象。
查看详情
收款链接——企业承诺额和一次性训练任务
50000 美元企业承诺额,或一次 8000 美元的微调任务,从你的销售工具或 CRM 生成一条收款链接。采购联系人按自己的节奏付款,webhook 把点数写进你的台账,财务完全不碰刷卡账单。适合大额 PoC 预算周期——整个流程走邮件,不走自助收银台。
查看详情今天跑在稳定币上的 AI 计费流
哪些推理和训练模式适合钱包通道?
四个真实生产流——图像推理、LLM token、GPU 租用、微调任务。
图像生成 API——按张计费
图像生成 API 每张收不到一分钱。研究者一个月生成几千张图,攒出一张不大的账单,刷卡通道没法实时处理。Paymos 在期末把这张账单几秒内结进你的 Paymos 余额,小额没有最低门槛——你按真实用量收费而不是凑整批量,而且之后不能被撤回。
LLM 推理计费——按 token 输出
按 token 计费的推理,客户一天可能只欠几美元——太小,刷卡没法实时收,正常做法是按周合并。Paymos 让你按天、按周、按任务开账单,没有最低金额:节奏你定,一次付款结清,完事。确认后款项进你的 Paymos 余额,单个客户 token 消耗差百倍也走同一个界面。
按分钟租 GPU——长训练任务
H100 按小时出租,几天的训练任务落在几百美元上下。任务结束时开一张稳定币账单,几秒内确认,钱立刻是你的——没有放款周期,没有压着的保证金。对一个月跑好几个任务的重度研究者来说,一笔不能被撤回的已付任务也是平台最干净的留存面。
微调和模型托管——每次几千美元
微调大模型一次几千美元,外加持续托管费。客户分别用两张稳定币账单结清,确认后直达你的 Paymos 余额。客户财务的采购联系人更喜欢一笔干净的付款,而不是落在不同账期的两笔刷卡——每跑一次付一次,付过就是付过了。
AI 平台的稳定币计费
常见问题
GPU 秒级计量、每秒不到一分钱,怎么处理?
预充值点数怎么运作?客户弃用了怎么办?
企业客户能先承诺 50000 美元、12 个月按量扣吗?
AI 研究者和企业 PoC 预算分别适合哪些网络?
训练失败或输出不理想,怎么退款?
这跟「计量计费插件加财资银行」的组合比怎么样?
诚实的适用边界
什么时候不该用 Paymos 做 AI 平台收款
四种钱包通道帮不上忙、应该用别的方案的情况。
你的模式是客户不到场就自动续费的平价套餐
稳定币钱包没法被定时扣款——没有存卡代扣,每笔付款都从客户发起。如果你的整个模型就是 20 美元月付静默续费,这条通道比刷卡多一步充值动作。自动续费留在卡上,把 Paymos 放在计量用量和预充值点数包上——那些本来就是客户主动付款的场景。
你依赖处理商的销售税引擎
Paymos 按你算好的税项开账单,但它不跟踪纳税门槛、不替你在新辖区注册、不替你申报。如果现在有个税务产品在帮你处理这些,那部分工作得继续有地方待。税务引擎留在原地,只把结算环节挪到钱包通道。
你的买家只认采购卡或 60 天 ACH 账期
如果理想客户是企业采购,规则写死了「公司采购卡或 net-60 ACH,其他免谈」,钱包通道进不了他们的采购对话。那条审批链上没人持有稳定币钱包,也不会为你的合同去开一个。这个细分继续用卡和 ACH 服务,把 Paymos 留给 AI 原生创业团队和国际研究团队。
你的客户是按指定支付工具付款的政府实验室
公共部门和联邦研究合同,会在合同里写明认可的支付工具,稳定币不在清单上。你的合同允许什么要自己去查——Paymos 不替你做这个判断——但任何集成都改变不了买方被允许用什么付。这部分收入留在规定的 ACH 通道上,商业部分用 Paymos 跑。
定价
每张结算账单 1.0%。没有 GPU 分钟附加费,没有最低金额
1.20 美元的推理批量账单和 50000 美元的企业承诺额,同一费率,不限金额。0.3% 要申请,第一张推理账单就能提,我们看月账单笔数和承诺额的大小。刷卡全算下来约 3%,还要叠每笔固定手续费和续费计费附加费——在小额推理账单上,光那笔固定费就能把实际费率推向两位数。
查看费率