跳到正文

一分钱也值得收

AI 平台用 USDC 结算按秒计费的推理用量,金额再小也行:一次两分钱的 A100 调用,没有每笔固定手续费就不亏——账单确认后直接进你的 Paymos 余额,没有放款周期,没有拒付窗口。

一分钱也值得收

GPU 秒级计费在哪里撞坏了刷卡通道

为什么不到一分钱的推理计费,在刷卡通道上要丢掉一截?

按秒计费的 GPU 定价,和为 50 美元电商客单设计的刷卡通道,有四处结构性错位。

每笔最低收费逼你合并计费,利润漏点被藏起来

一次 A100 推理,客户实际消耗可能不到两分钱。刷卡通道不收这么小的扣款,你只能按小时或按天合并成 5 到 20 美元的批量账单。每批都带一笔固定手续费加百分比,5 美元的批量账单可能被手续费吃掉约 9%。大推理平台都这么干、也都默默扛着——客户看到的是一笔说不清的「平台费」,你看到的是一笔说不清的「处理成本」。

预充值没花完不是白赚,是要挂账的负债

AI 平台的标准卖法是「充 50 美元点数,几个月慢慢烧」,其中相当一部分永远不会被用完。表面看是白拿的毛利,实际上你欠着客户:客户要求退款或合规政策触发时,你得退。那笔漂着的预收款是要记账、要最终归还的负债,不是意外之财。

AI 客户大多在海外,卡覆盖到处是缺口

做 ML 研究的人遍布全球——拉美、南亚、东南亚、中东、非洲。很多地区的发卡行对境外 SaaS 扣款的拒付率很高,客户还要再扛一层货币转换费和本地税。一个月愿意付 20 美元的客户,可能在第二次验证跳转时放弃整个流程。

企业「预付承诺、按量消耗」塞不进刷卡账单模型

大企业 PoC 预算的常见结构是「先承诺 50000 美元,12 个月按量扣」。刷卡计费的对象模型里没有余额台账,你只能在自己数据库里另记一本账,再跟处理商的用量对象对账。承诺消费的基础设施得自己造,因为对方承诺的「50000 美元承诺额」根本放不进标准计费对象里。

期末一次结算怎么贴合推理经济

用量变成一笔稳定币付款后,什么变了?

四个让 GPU 秒级计费回本的机制。

你计 GPU 秒数,Paymos 开汇总账单——没有最低收费

你的计量器按自己的节奏聚合 GPU 秒数、推理 token 或训练点数——按小时、按天、按周、按任务都行。你调用一次,Paymos 就开一张结算账单,金额随意:1.20、14.40、847 美元。没有每笔固定手续费、没有最低金额,账单是一美元还是五万美元,费率都一样。实时按秒计费,再小的调用也值得收。

预充值就是你库里的一条余额,退款就是一笔转账

客户预付 50 美元,款项进你的 Paymos 余额,你的数据库给客户点数加一笔。用量消耗时往下扣——没有外部余额对象要对账。客户弃用要求退款,或你的合规政策要求退还时,你从自己的 Paymos 余额发一笔转出。没有按笔的退款手续费,没有「原卡还有效吗」这种问题,链上流水还留下干净的记录。

哪个国家来付都一样,也不会因此被掐断

稳定币付款没有国家代码。从卡拉奇发来的转账和从山景城发来的,费率一样、确认时间一样,没有汇率加价、没有按国家拒付、没有叠在 20 美元订阅上的本地税。之前被二次验证挡住的拉美、中东、东南亚研究者终于能付款了——也没有处理商会因为你服务这些地区而冻结你的账户。

企业承诺额落地:一张账单、一个 webhook、你的点数台账

大额 PoC 先付 50000 美元承诺额,你开一张全额账单。结算后 Paymos 发出 HMAC-SHA256 webhook,你的处理程序给客户 GPU 预算入账,用量在你自己的台账里往下扣。不用账单计划变通,不用平行对账。客户签一次名,付款确认即 final,台账归你管,通道只是一个 webhook。

今天跑在稳定币上的 AI 计费流

哪些推理和训练模式适合钱包通道?

四个真实生产流——图像推理、LLM token、GPU 租用、微调任务。

图像生成 API——按张计费

图像生成 API 每张收不到一分钱。研究者一个月生成几千张图,攒出一张不大的账单,刷卡通道没法实时处理。Paymos 在期末把这张账单几秒内结进你的 Paymos 余额,小额没有最低门槛——你按真实用量收费而不是凑整批量,而且之后不能被撤回。

LLM 推理计费——按 token 输出

按 token 计费的推理,客户一天可能只欠几美元——太小,刷卡没法实时收,正常做法是按周合并。Paymos 让你按天、按周、按任务开账单,没有最低金额:节奏你定,一次付款结清,完事。确认后款项进你的 Paymos 余额,单个客户 token 消耗差百倍也走同一个界面。

按分钟租 GPU——长训练任务

H100 按小时出租,几天的训练任务落在几百美元上下。任务结束时开一张稳定币账单,几秒内确认,钱立刻是你的——没有放款周期,没有压着的保证金。对一个月跑好几个任务的重度研究者来说,一笔不能被撤回的已付任务也是平台最干净的留存面。

微调和模型托管——每次几千美元

微调大模型一次几千美元,外加持续托管费。客户分别用两张稳定币账单结清,确认后直达你的 Paymos 余额。客户财务的采购联系人更喜欢一笔干净的付款,而不是落在不同账期的两笔刷卡——每跑一次付一次,付过就是付过了。

AI 平台的稳定币计费

常见问题

GPU 秒级计量、每秒不到一分钱,怎么处理?
计量留在你自己的技术栈里——你本来就有,因为通用计量计费不够用。Paymos 不替代计量器,替代的是把计量结果变成钱的通道。你按自己的节奏聚合 GPU 秒数、推理 token 或训练点数(按小时、按天、按周、按任务),然后把得出的金额交给 Paymos 开账单。没有每笔固定手续费和最低金额,账单是五十美分还是五万美元,费率都一样。
预充值点数怎么运作?客户弃用了怎么办?
客户通过 Paymos 账单预付点数包。结算进你的 Paymos 余额,你的数据库给点数余额加一笔,用量往下烧。客户不再回来,余额就挂在你的账上当递延收入,直到退款或合规政策触发。触发时你从自己的 Paymos 余额发一笔链上转回——不依赖卡库,没有「原卡已失效」这种失败,链上流水也满足留存记录的要求。
企业客户能先承诺 50000 美元、12 个月按量扣吗?
可以,而且架构比刷卡处理商的订阅计划对象简单。你就承诺额开一张 Paymos 账单,结算后我们向你的端点发 HMAC-SHA256 webhook,你的处理程序按约定单位数给客户的 GPU 预算台账入账,用量在你的计费引擎里往下扣。Paymos 的职责止于「钱到了」——承诺消费的逻辑留在你的代码里,那才是它该待的地方。
AI 研究者和企业 PoC 预算分别适合哪些网络?
让每个客户在已经持有资金的链上付。月付 20 到 500 美元的独立研究者,用 Base 和 Polygon 时网络费很低,小额充值划算。企业 PoC 预算通常走 Ethereum,那是对方托管方本来就在对账的链。拉美、中东、东南亚的研究者默认持有 Tron 上的 USDT——图的是流动性:那是他们在当地真能花出去的余额。USDC 横跨所有这些场景,也是 AI 金库好持有的资产。
训练失败或输出不理想,怎么退款?
退多少只有你自己的计量知道:任务崩之前烧掉多少 GPU 时长是它记下的,付款那一侧没有这个数。客户任务中途崩了,你要退还这些时长,就通过控制台或 API 从你的 Paymos 余额向客户钱包发一笔转出。没有按笔的退款手续费。常见政策是「收敛前报错的任务全额退,收敛了但输出差的给部分点数」——两者在机制上完全一样。
这跟「计量计费插件加财资银行」的组合比怎么样?
计量计费插件管聚合,但要在刷卡手续费之外再加一层费。Paymos 替代的是收款层,不是你的计量器:按产品需要的节奏聚合用量,开一张稳定币账单,确认后款项进你的 Paymos 余额。需要法币的话,把稳定币转到你自己的交易所账户,在 Paymos 之外兑换。

诚实的适用边界

什么时候不该用 Paymos 做 AI 平台收款

四种钱包通道帮不上忙、应该用别的方案的情况。

你的模式是客户不到场就自动续费的平价套餐

稳定币钱包没法被定时扣款——没有存卡代扣,每笔付款都从客户发起。如果你的整个模型就是 20 美元月付静默续费,这条通道比刷卡多一步充值动作。自动续费留在卡上,把 Paymos 放在计量用量和预充值点数包上——那些本来就是客户主动付款的场景。

你依赖处理商的销售税引擎

Paymos 按你算好的税项开账单,但它不跟踪纳税门槛、不替你在新辖区注册、不替你申报。如果现在有个税务产品在帮你处理这些,那部分工作得继续有地方待。税务引擎留在原地,只把结算环节挪到钱包通道。

你的买家只认采购卡或 60 天 ACH 账期

如果理想客户是企业采购,规则写死了「公司采购卡或 net-60 ACH,其他免谈」,钱包通道进不了他们的采购对话。那条审批链上没人持有稳定币钱包,也不会为你的合同去开一个。这个细分继续用卡和 ACH 服务,把 Paymos 留给 AI 原生创业团队和国际研究团队。

你的客户是按指定支付工具付款的政府实验室

公共部门和联邦研究合同,会在合同里写明认可的支付工具,稳定币不在清单上。你的合同允许什么要自己去查——Paymos 不替你做这个判断——但任何集成都改变不了买方被允许用什么付。这部分收入留在规定的 ACH 通道上,商业部分用 Paymos 跑。

定价

每张结算账单 1.0%。没有 GPU 分钟附加费,没有最低金额

1.20 美元的推理批量账单和 50000 美元的企业承诺额,同一费率,不限金额。0.3% 要申请,第一张推理账单就能提,我们看月账单笔数和承诺额的大小。刷卡全算下来约 3%,还要叠每笔固定手续费和续费计费附加费——在小额推理账单上,光那笔固定费就能把实际费率推向两位数。

查看费率

你卖出的是哪个 GPU 秒,就收哪个——没有最低收费,没有事后撤回