OpenAI ha comenzado a permitir que algunos clientes paguen solo cuando la IA funciona.
OpenAI ha comenzado a permitir que algunos de sus clientes más grandes paguen solo cuando su IA realmente completa el trabajo. Kevin McLaughlin y Amir Efrati informaron sobre el cambio a The Information, dando el ejemplo de una interacción de soporte al cliente manejada de principio a fin.
El acuerdo está limitado a cuentas importantes seleccionadas en lugar de ofrecerse de manera general, y OpenAI no lo ha anunciado. TNW no ha verificado de manera independiente el informe, y los términos, los clientes y los precios son todos desconocidos.
El nombre de la industria para esto es precios basados en resultados, y el atractivo para un director financiero no es sutil. Una factura que llega solo cuando algo funcionó es considerablemente más fácil de defender que una que llega independientemente.
La facturación por tokens ha hecho de eso un problema real. Un desarrollador que ejecuta cien agentes en paralelo acumuló $1.3 millones en tokens de OpenAI en treinta días, lo cual es un caso extremo de un patrón general donde el costo escala con los intentos en lugar de los resultados.
El soporte al cliente es donde el modelo ya se ha asentado, porque una resolución es una de las pocas salidas de IA que cualquiera puede definir. Intercom cobra $0.99 por cada conversación que su agente Fin resuelve, y nada en absoluto por las que no resuelve.
Zendesk fue más lejos en mayo, restringiendo la facturación a lo que llama Resoluciones Verificadas, confirmadas por una evaluación de LLM dentro de las 72 horas posteriores a la conversación. Las escalaciones asistidas y las resoluciones contenidas se volvieron gratuitas, y la tarifa facturable se sitúa en aproximadamente $1.20 a $1.50 por volumen comprometido.
Salesforce ha estado trabajando en la misma pregunta en público y de manera más incómoda. Agentforce se lanzó a $2 por conversación, cobrando por cada sesión de 24 horas, ya sea que se resolviera algo o no, lo que los clientes encontraron tanto costoso como imposible de prever.
Los Créditos Flex llegaron como la respuesta, moviendo el medidor de conversaciones a acciones individuales a aproximadamente 10 centavos cada una, comenzando en $500 por 100,000 créditos. Eso es precios de consumo en lugar de precios por resultados, y la distinción importa, porque una acción que falla aún factura.
Los compradores parecen querer ambos, en ese orden. Futurum Group encontró en mayo que el 43% de ellos prefiere modelos basados en consumo y el 27% prefiere modelos basados en resultados, con menos de uno de cada cinco que aún prefiere pagar por usuario.
“Los precios basados en resultados se están convirtiendo en un estándar de mercado”, escribió Keith Kirkpatrick, el director de investigación de la firma para software empresarial, cuyo hallazgo más agudo es que los proveedores que ofrecen asientos solos ahora están siendo descalificados antes de que comience la evaluación.
Para OpenAI, el movimiento es un cambio de posición en lugar de un nuevo producto. Ha vendido capacidad por token, con precios por modelo y por llamada, y permitir que una empresa pague por el trabajo completado en su lugar significa aceptar el riesgo de que el trabajo no se complete.
Ese riesgo tiene que ser valorado en algún lugar, y la pregunta interesante es dónde. Un proveedor confiado en su tasa de éxito puede permitirse el acuerdo, mientras que uno que no lo está tiene que cargar el precio por éxito hasta que la economía coincida, que es por qué las tarifas por resolución se agrupan alrededor de un dólar en lugar de un centavo.
También cambia quién asume el costo de una mala respuesta. Bajo la facturación por tokens, el cliente paga por cada intento fallido, mientras que bajo la facturación por resultados el proveedor los absorbe, lo que es una transferencia significativa de riesgo del comprador a la empresa que construyó el modelo.
La parte más difícil es acordar qué significa el éxito. Una resolución es definible, pero el trabajo agente que OpenAI ha estado promoviendo, con 10 millones de usuarios en sus agentes, implica tareas de múltiples pasos donde la finalización es una cuestión de juicio en lugar de un campo en una base de datos.
Hay una razón comercial para querer que se resuelva rápidamente. Una empresa que no puede prever una factura tiende a ejecutar un piloto indefinidamente en lugar de firmar, y la fijación de precios por resultados elimina la objeción exactamente en el punto del ciclo de ventas donde generalmente se detiene.
Nada de eso está resuelto, y nada de ello es público. Lo que está en el registro es que el mayor proveedor de modelos ha comenzado, de manera silenciosa y selectiva, a vender resultados en lugar de capacidad.
Otros artículos
OpenAI ha comenzado a permitir que algunos clientes paguen solo cuando la IA funciona.
Las grandes cuentas seleccionadas ahora pueden pagar por tareas completadas en lugar de tokens, informa The Information, siguiendo a Intercom, Zendesk y Salesforce en la fijación de precios por resultados.
