Casi todas las herramientas de soporte con IA cobran por resolución o por asiento, y el número que ves no te dice de dónde sale. Acá se cobra por respuesta generada, y el costo de cada una depende de dos cosas que podés controlar.
Un modelo cobra por token, y un token es más o menos tres cuartos de una palabra. Cada respuesta usa tokens de dos tipos, y no valen lo mismo.
| Qué es | De dónde sale | Peso en el costo |
|---|---|---|
| Entrada | Tu documentación, más el historial de la conversación | Es el volumen grande, pero el token es barato |
| Salida | El texto que escribe el asistente | Es poco texto, pero el token cuesta seis veces más |
De ahí salen las dos palancas. La primera es cuánta documentación tenés: cada respuesta manda tu contenido al modelo, así que una base más grande encarece todas las respuestas, no solo las que la usan. La segunda es cuánto escribe el asistente: respuestas breves y al grano cuestan bastante menos que respuestas largas.
Si tu documentación crece mucho, conviene revisar que los artículos estén enfocados. Diez artículos que responden diez preguntas concretas cuestan menos por respuesta que tres artículos larguísimos que lo cubren todo.
Se te cobra el costo real del modelo más un margen fijo, convertido a pesos al dólar del día. No hay costo por asiento ni mínimo mensual: si un mes nadie escribe, la IA no cuesta nada.
Los créditos son prepagos y no vencen. Los cargás cuando querés y se descuentan por respuesta, así que el techo de gasto es lo que cargaste: no existe la factura sorpresa a fin de mes.
Cuando te quedás sin créditos la IA se pausa sola. El widget sigue funcionando y las conversaciones siguen llegando a tu inbox, solo que las contestás vos.
Si ya tenés una cuenta de OpenAI, podés cargar tu propia API key. A partir de ahí todas las respuestas salen con ella: le pagás directo a OpenAI al precio de lista y no consumís créditos nuestros. Es la opción más barata si ya tenés volumen, y está disponible durante la prueba, así que podés medirlo antes de decidir nada.
Todo eso funciona sin consumir nada. Lo único que se mide por uso son las respuestas que genera la IA.