Noticias

apisesdks

CONFIRMADO: OpenRouter lanza la Batch API y reduce a la mitad el precio de más de 70 modelos

CONFIRMADO: OpenRouter lanzó su Batch API el 22 de septiembre, con un descuento del 50% en el precio por token de entrada y salida en más de 70 modelos, para tareas que no necesitan respuesta inmediata y se entregan en un plazo de hasta 24 horas.

OpenRouter Batch API
[{"h":"CONFIRMADO: el procesamiento por lotes ahora cuesta la mitad en OpenRouter","p":"OpenRouter, la plataforma que agrega acceso a decenas de modelos de IA a traves de una sola API y hoy controlada por Stripe, lanzo oficialmente su Batch API el 22 de septiembre. La funcion reduce a la mitad el precio por token, tanto de entrada como de salida, en mas de 70 modelos soportados, para tareas que no requieren una respuesta en tiempo real."},{"h":"Como funciona el descuento","p":"La logica es simple: en lugar de pagar el precio completo por una respuesta inmediata, el desarrollador envia un lote de solicitudes que se procesan de forma asincrona, con la garantia de que todos los resultados llegaran en un plazo de 24 horas. A cambio de esa espera, el precio por token cae a la mitad tanto para el texto enviado como para el texto generado por el modelo."},{"h":"Los numeros del periodo de prueba","p":"Durante dos semanas de prueba antes del lanzamiento oficial, la plataforma proceso mas de 230.000 tareas en lote, con un tiempo mediano de finalizacion de siete minutos y el 90% de las tareas terminadas en una hora, muy por debajo del techo prometido de 24 horas. Esto indica que, en la practica, la mayoria de las tareas vuelve rapido, y el plazo de un dia funciona mas como una garantia minima que como el tiempo tipico de espera."},{"h":"Para que tipo de tarea sirve esto","p":"El procesamiento por lotes es la opcion correcta para trabajos que pueden esperar minutos o algunas horas: clasificar una gran base de mensajes de atencion, generar descripciones de producto en masa, resumir un gran volumen de documentos o ejecutar analisis de sentimiento sobre el historial de conversaciones. No sirve para un chatbot que responde a un cliente en tiempo real, donde el usuario espera una respuesta inmediata."},{"h":"Por que esto importa para quien opera con presupuesto ajustado","p":"Para una pequena o mediana empresa que usa IA en tareas de trasfondo, como organizar hojas de calculo, generar contenido en lote o procesar formularios, un recorte del 50% en el costo por token cambia la cuenta de forma directa: el mismo presupuesto mensual ahora cubre el doble de volumen, siempre que la tarea acepte no ser instantanea. Es un recordatorio practico de que optimizar el costo de IA muchas veces tiene menos que ver con cambiar de modelo y mas con elegir el modo de procesamiento correcto para cada tarea."},{"h":"La lectura de MaxAssistant","p":"El lanzamiento refuerza una tendencia que ya aparecia en otros proveedores de IA: precios segun urgencia, no solo segun modelo. Vale la pena mapear, dentro de la propia operacion, que tareas de IA realmente necesitan respuesta instantanea y cuales podrian correr en lote durante la madrugada por la mitad del costo."},{"h":"Fuentes","p":"OpenRouter, OpenRouter Batch API, half-price inference by bundling requests: https://openrouter.ai/blog/announcements/batch-api/ | PANews, AI model aggregation platform OpenRouter launches Batch API, token prices halved for most models: https://panews.io/articles/01a0cc16-5bb5-74e7-8803-5263c7a4fc27 | Phemex News, OpenRouter Batch API Launch, 50% Off Tokens for 70+ AI Models: https://phemex.com/news/article/openrouter-launches-batch-api-with-50-token-price-reduction-across-70-models-97535"}]