Ir al contenido

Pasarela de pagos cripto para IA: cobra cualquier importe, hasta un centavo

Liquida la inferencia medida en USDC sea cual sea el importe: una ejecución de A100 de dos centavos vale la pena cobrarla cuando no hay mínimo por cargo, y la factura se confirma directa en tu saldo de Paymos, sin ciclo de pagos y sin ventana de contracargos.

Pasarela de pagos cripto para IA: cobra cualquier importe, hasta un centavo

Donde el cobro por segundo de GPU rompe la vía de la tarjeta

¿Por qué cobrar inferencia de menos de un centavo pierde un tercio en comisiones fijas con tarjeta?

Cuatro desajustes estructurales entre el precio por segundo de GPU y una vía de tarjeta pensada para cestas de 50 $ de e-commerce.

El suelo de cargo mínimo obliga a agrupar y esconde la fuga de margen

Una ejecución de inferencia en una A100 puede costarle al cliente menos de dos centavos. Los procesadores de tarjeta no liquidan cargos diminutos, así que agrupas el consumo en bloques de 5 a 20 $ al cierre de la hora o del día. Cada bloque lleva un importe fijo más un porcentaje, así que un bloque de inferencia de 5 $ puede dejarse alrededor del 9 % en procesamiento. Las grandes plataformas de inferencia cobran todas así y lo absorben en silencio: aparece como una vaga «comisión de plataforma» en el extracto del cliente y como «coste de procesamiento» en el tuyo.

El crédito prepagado abandonado se convierte en pasivo, no en ingreso extra

El modelo estándar de una plataforma de IA es «compra 50 $ de créditos y consúmelos en meses», y buena parte de esos créditos no se gasta nunca. Sobre el papel parece margen gratis, pero las leyes estadounidenses de bienes no reclamados (con plazos de varios años) y las normas sobre renovación tácita obligan a devolverlo o a entregarlo al Estado tarde o temprano. El saldo abandonado se convierte en una obligación regulatoria que tienes que seguir y acabar devolviendo, no en el regalo que parecía.

La mayoría de los clientes de IA son internacionales, y ahí la tarjeta tiene agujeros

La base de investigadores de aprendizaje automático es global: Argentina, Pakistán, India, Vietnam, Nigeria, Ucrania. Los procesadores de tarjeta no dan de alta comercios en decenas de esos países, y un emisor de muchos de ellos acumula rechazos altísimos en plataformas con sede en Estados Unidos. Un cliente argentino puede encontrarse un recargo fuerte por conversión de moneda más impuestos locales encima de tu precio de suscripción. El cliente que pagaría encantado 20 $ al mes abandona el flujo de la tarjeta en el segundo reto de autenticación.

El compromiso Enterprise no encaja en el modelo de factura de la tarjeta

Los presupuestos de prueba de concepto de una gran empresa funcionan como «50.000 $ comprometidos por adelantado, consumidos en 12 meses». Los objetos de factura del cobro con tarjeta no modelan de forma nativa un libro de saldos: acabas montando uno en tu propia base de datos y conciliándolo contra los objetos de consumo medido del procesador. Las grandes plataformas de inferencia llevan todas una infraestructura propia de compromiso y consumo sobre Postgres, porque el «compromiso de 50.000 $» que prometió el comercial no cabe en el grafo de objetos estándar de facturación.

Por qué facturar al cierre encaja con la economía de la inferencia

¿Qué cambia cuando el consumo se liquida en un solo pago en stablecoins?

Cuatro mecánicas que convierten el segundo de GPU en una unidad económica rentable.

Tú mides los segundos de GPU, Paymos factura el bloque, sin mínimo

Tu contador agrega segundos de GPU, tokens de inferencia o créditos de entrenamiento con la cadencia que te convenga: por hora, por día, por semana o por trabajo. Paymos emite una factura de liquidación cuando nos llamas, por el importe que sea: 1,20 $, 14,40 $, 847 $. No hay importe fijo por factura ni mínimo, así que el porcentaje se mantiene proporcional tanto si la factura es de un dólar como si es de cincuenta mil. Cobrar en tiempo real por segundo pasa a merecer la pena con cualquier granularidad, incluso en la ejecución más pequeña.

Los créditos prepagados son un saldo en tu base de datos; devolverlos es una transferencia

El cliente prepaga 50 $, el pago se abona en tu saldo de Paymos y tu base de datos le incrementa el crédito. Según lo va consumiendo, tú lo descuentas: no hay ningún objeto de saldo externo contra el que conciliar. Si el cliente se marcha y pide una devolución, o si tu jurisdicción te obliga a ella, inicias una transferencia saliente desde tu saldo de Paymos. No hay comisión por devolución, no hay pregunta de «¿seguirá existiendo la tarjeta original?» y un rastro de pago verificable te da registros limpios para los requisitos de bienes no reclamados.

Todos los países liquidan igual y ninguno te deja fuera

Los pagos en stablecoins no ven códigos de país. Una transferencia desde Karachi se abona en tu saldo de Paymos igual que una desde Mountain View: mismo porcentaje, mismo tiempo de confirmación, sin margen en el tipo de cambio, sin rechazos del emisor por país y sin impuestos locales apilándose sobre una suscripción de 20 $. El segmento de investigadores de América Latina, Oriente Medio y el Sudeste Asiático que rebotaba en la reautenticación de la tarjeta por fin puede pagar, y ningún procesador puede cerrarte por atenderlo.

Los compromisos Enterprise llegan como factura, webhook y tu libro de créditos

Para una prueba de concepto de gran empresa con 50.000 $ por adelantado, generas una sola factura por el compromiso completo. Al liquidarse, Paymos dispara un webhook firmado con HMAC-SHA256, tu manejador abona el presupuesto de GPU del cliente y el consumo lo va reduciendo. Sin trucos de calendario de facturas y sin conciliación paralela. El cliente firma una vez, el pago es definitivo en cuanto se confirma, el libro sigue siendo tuyo y toda la vía cabe en un webhook.

Cómo conectan las plataformas de IA Paymos a su cobro actual

¿Cómo añades Paymos encima de tu contador de consumo?

Tres caminos de integración según la profundidad del motor de cobro y el perfil técnico del equipo.

Pago integrado: flujo de recarga dentro de tu consola

Pago integrado: flujo de recarga dentro de tu consola

El investigador abre tu panel, pulsa «Añadir créditos», elige 50 o 500 $ y el pago integrado resuelve el cobro sin salir de tu dominio. Tu interfaz de saldo de créditos sigue siendo la fuente de verdad; Paymos solo pone la vía. Lo usan plataformas con consolas interactivas donde el paso de la billetera tiene que sentirse nativo y no una salida a otro sitio.

Ver detalles
API Host-to-Host: para contadores propios y libros de compromiso y consumo

API Host-to-Host: para contadores propios y libros de compromiso y consumo

Si ya construiste un contador de consumo sobre Postgres (porque el cobro por consumo genérico no era lo bastante fino), la API Host-to-Host te deja crear facturas a tu ritmo, ver las confirmaciones en las redes que usan tus clientes y señalar el cierre del periodo de facturación con webhooks firmados con HMAC-SHA256. Tu planificador cierra el contador, llama a Paymos, la billetera del cliente liquida y tus cobros se concilian, sin ningún objeto de suscripción de terceros por el medio.

Ver detalles
Enlaces de cobro para compromisos Enterprise y entrenamientos puntuales

Enlaces de cobro para compromisos Enterprise y entrenamientos puntuales

Para un compromiso Enterprise de 50.000 $ o un ajuste fino puntual de 8.000 $, genera un enlace de cobro desde tu herramienta de ventas o tu CRM. El contacto de compras paga cuando le toca, el webhook deja el crédito en tu libro y tu equipo financiero no toca ninguna factura de tarjeta. Útil para el ciclo presupuestario de una prueba de concepto corporativa, donde el trato va por correo y no por una página de autoservicio.

Ver detalles

Flujos de cobro de IA que ya funcionan en stablecoins

¿Qué patrones de inferencia y entrenamiento funcionan sobre billetera?

Cuatro flujos en producción: inferencia de imagen, tokens de LLM, alquiler de GPU y ajustes finos.

API de generación de imágenes: inferencia por imagen, al estilo Replicate o Stability

Una API de generación de imágenes cobra una fracción de centavo por imagen. Un investigador que genera miles de imágenes en un mes acumula una factura modesta que la tarjeta no puede procesar en tiempo real. Paymos liquida la factura de cierre de periodo en segundos en tu saldo de Paymos, sin suelo mínimo sobre el importe pequeño: cobras el consumo real en vez de redondearlo dentro de un bloque, y después no te lo pueden reclamar.

Cobro de inferencia de LLM: por token de salida, al estilo Together o Fireworks

La inferencia por tokens puede dejar a un cliente debiendo unos pocos dólares al día: demasiado poco para que una tarjeta lo procese en tiempo real, así que normalmente lo agruparías por semanas. Paymos te deja facturar a diario, por semana o por trabajo sin mínimo: eliges la cadencia, liquidas un pago y listo. El importe se abona en tu saldo de Paymos al confirmarse, y el consumo de tokens por cliente, que varía cien veces de uno a otro, pasa por la misma superficie.

Alquiler de GPU por minutos: trabajos largos al estilo RunPod o Vast.ai

Una H100 se alquila por horas y un entrenamiento de varios días acaba en unos cientos de dólares. Liquidado al cierre del trabajo como una sola factura en stablecoins, se confirma en segundos y el dinero es tuyo de inmediato: sin ciclo de pagos y sin reserva retenida. Para el investigador avanzado que lanza varios trabajos al mes, una ejecución pagada que no se puede revertir es además la superficie de retención más limpia de la plataforma.

Ajuste fino y alojamiento de modelos propios: unos miles por ejecución

Ajustar un modelo grande cuesta unos miles de dólares por ejecución, más el alojamiento continuo. El cliente liquida ambas cosas como facturas separadas en stablecoins que se abonan en tu saldo de Paymos al confirmarse. El contacto de tesorería del cliente prefiere un pago limpio a dos cargos de tarjeta cayendo en ciclos de extracto distintos, y una vez pagada, cada ejecución se queda pagada.

Cobro de plataformas de IA en stablecoins

Preguntas frecuentes

¿Cómo se gestiona la medición por segundo de GPU cuando cada unidad vale menos de un centavo?
La medición se queda en tu sistema: ya la tienes, precisamente porque el cobro por consumo genérico no te encajaba. Paymos no sustituye el contador; sustituye la vía que liquida su resultado. Agregas segundos de GPU, tokens de inferencia o créditos de entrenamiento con la cadencia que pida tu perfil de consumo (por hora, por día, por semana o por trabajo) y luego llamas a Paymos con el importe de la factura. Como no hay importe fijo por factura ni mínimo, el porcentaje se mantiene proporcional tanto si la factura es de cincuenta centavos como si es de cincuenta mil dólares.
¿Cómo es el modelo de créditos prepagados y qué pasa si el cliente se marcha?
El cliente prepaga un paquete de créditos con una factura de Paymos. La liquidación entra en tu saldo de Paymos, tu base de datos incrementa el crédito y el consumo lo va reduciendo. Si el cliente no vuelve, el saldo se queda en tus libros como ingreso diferido hasta que se active tu política de devolución o de entrega al Estado. Cuando se active, inicias una transferencia en cadena de vuelta desde tu saldo de Paymos: sin depender de ninguna bóveda de tarjetas, sin el fallo de «la tarjeta ya no vale», y con un rastro en cadena que cumple los requisitos de registro de bienes no reclamados.
¿Pueden los clientes Enterprise comprometer 50.000 $ por adelantado y consumirlos en 12 meses?
Sí, y la arquitectura es más simple que los objetos de calendario de suscripción de un procesador de tarjetas. Emites una única factura de Paymos por el importe comprometido. Al liquidarse, disparamos un webhook firmado con HMAC-SHA256 hacia tu endpoint. Tu manejador abona el libro de presupuesto de GPU del cliente por las unidades acordadas y el consumo lo va reduciendo dentro de tu motor de cobro. El papel de Paymos termina en «el dinero llegó»: la lógica de compromiso y consumo se queda en tu código, que es donde le toca.
¿Qué redes van mejor para investigadores y cuáles para presupuestos de prueba de concepto Enterprise?
Deja que cada cliente pague en la cadena que ya usa. Para investigadores independientes de 20 a 500 $ al mes, Base y Polygon dejan la comisión de red lo bastante baja como para que las recargas pequeñas sigan saliendo a cuenta. Los presupuestos de prueba de concepto Enterprise suelen liquidarse en Ethereum, la cadena que su equipo de custodia ya concilia. En América Latina, Oriente Medio y el Sudeste Asiático, USDT en Tron es lo que tienen muchos investigadores, por liquidez: es el saldo que de verdad pueden gastar donde están. USDC cubre todo lo anterior y es un activo limpio para la tesorería de una empresa de IA.
¿Cómo se devuelve el dinero de un entrenamiento fallido o de un resultado malo?
Cuánto devolver solo lo sabe tu propio medidor: él registró cuántas horas de GPU quemó el trabajo antes de caerse y en el lado del pago ese dato no existe. Si el trabajo de un cliente se cae a mitad de ejecución y quieres devolverle esas horas, inicias una transferencia saliente desde tu saldo de Paymos a su billetera, desde el panel o por API. No hay comisión de procesamiento por devolución. Una política habitual es «devolución completa si la ejecución falla antes de converger y crédito parcial si converge con mal resultado»: mecánicamente las dos funcionan igual.
¿En qué se diferencia esto de un módulo de cobro por consumo más un banco de tesorería para startups de IA?
Un módulo de cobro por consumo resuelve la agregación, pero suma otra comisión encima del procesamiento con tarjeta. Paymos sustituye la capa de pago, no tu contador: agregas el consumo con la cadencia que pida tu producto, emites una factura en stablecoins y el pago confirmado se abona en tu saldo de Paymos. Si necesitas fiat, retiras la stablecoin a tu propia cuenta de exchange y la conviertes fuera de Paymos.

Cuándo no encaja

Cuándo NO usar Paymos en una plataforma de IA

Cuatro casos en los que la vía de la billetera no le sirve a una plataforma de IA, y qué usar en su lugar.

Necesitas planes de cuota fija que se renueven sin que el cliente aparezca

A una billetera de stablecoins no se le puede cobrar según un calendario: no existe el cargo contra una tarjeta guardada, así que todo pago empieza en el cliente. Si tu modelo entero es un plan de 20 $ al mes que se renueva en silencio, esta vía añade un paso de recarga que tu flujo de tarjeta no tiene. Deja la renovación automática en la tarjeta y pon Paymos debajo del consumo medido y de los paquetes de créditos prepagados, donde el pago ya lo inicia el cliente.

Dependes del motor de impuestos de tu procesador

Paymos factura el desglose de impuestos que tú calcules, pero no vigila umbrales de nexo fiscal, ni te registra en estados nuevos, ni presenta por ti. Si hoy un producto fiscal hace ese trabajo en los estados de EE. UU. donde vendes, ese trabajo tiene que seguir viviendo en algún sitio. Deja el motor fiscal donde está y mueve a la billetera solo el tramo de liquidación.

Tus compradores solo aprueban tarjeta de compras o ACH a 60 días

Cuando el cliente ideal es un departamento de compras con una regla fija —tarjeta corporativa de compras o ACH a 60 días y nada más—, la vía de la billetera no llega ni a la conversación. Nadie en esa cadena de aprobación tiene una billetera de stablecoins y no la va a abrir por tu contrato. Atiende a ese segmento con tarjeta y ACH, y trae Paymos para las startups nativas de IA y los equipos de investigación internacionales.

Vendes a laboratorios públicos con instrumentos de pago obligatorios

Los contratos de investigación del sector público especifican en el propio contrato los instrumentos de pago admitidos, y las stablecoins no están en esa lista. Comprobar qué permite tu contrato es cosa tuya —Paymos no decide sobre eso—, pero ninguna integración cambia con qué puede pagar el comprador. Deja esos ingresos en el ACH obligatorio y usa Paymos para el lado comercial.

Precios

1,0 % por factura liquidada. Sin recargo por minuto de GPU y sin mínimo

El bloque de inferencia de 1,20 $ y el compromiso de 50.000 $ pagan el mismo porcentaje. El 0,3 % se pide con la primera factura: pesan cuántas emites y su importe. Con tarjeta se ronda el 3 % todo incluido con el fijo y el módulo de recurrencia; en un bloque pequeño ese suelo lo empuja a dos dígitos.

Ver precios

Cobra el segundo de GPU que vendiste de verdad: sin mínimo y sin reversiones