Skill · Claude Platform Documentation & Anthropic Blog
Procesa datos masivos con la API Batch de Claude con un 50 % de descuento
Foto: Taylor Vick en Unsplash
La API Batch de Claude procesa hasta 10 000 solicitudes de forma asíncrona en menos de 24 horas por exactamente la mitad del coste normal. Perfecta para analizar grandes conjuntos de datos, clasificar tickets de soporte o procesar repositorios de documentos donde las respuestas en tiempo real no son críticas: convierte costosas llamadas a la API una por una en operaciones masivas económicas.
La API Batch está diseñada específicamente para cargas de trabajo que no dependen del tiempo y en las que el coste importa más que la latencia. En lugar de hacer llamadas individuales a la API que te cuestan por solicitud, envías un archivo por lotes que contiene hasta 10 000 solicitudes, y Claude las procesa todas de forma asíncrona y devuelve los resultados en bloque, al 50 % del precio estándar tanto para los tokens de entrada como de salida. Un solo lote tarda menos de 24 horas en completarse, lo que lo hace ideal para canalizaciones de procesamiento nocturno.
La aplicación práctica: imagina que un equipo de éxito del cliente necesita analizar 2000 tickets de soporte para identificar categorías de quejas comunes, sugerir respuestas y etiquetar niveles de prioridad. Ejecutar cada ticket por la API individualmente a tarifas estándar costaría 500 $. Los mismos 2000 tickets procesados como un solo lote cuestan 250 $. Envías el lote a las 5 de la tarde, obtienes los resultados a las 9 de la mañana del día siguiente y tus resultados están listos para que el equipo los revise en la reunión diaria. Para los equipos que procesan documentos a escala (analizar informes trimestrales, extraer datos de contratos o revisar repositorios de código), la API Batch hace que el análisis sea económicamente viable.
El flujo de trabajo es sencillo: formatea tus solicitudes como un archivo JSONL (una solicitud por línea), llama al endpoint de lotes con tu archivo, recibe un ID de lote y consulta su finalización periódicamente. La API gestiona los reintentos automáticamente, incluidas las solicitudes limitadas por throttling, así que no necesitas gestionar reintentos manuales. La salida se devuelve en el mismo orden que tu entrada, lo que facilita asignar los resultados de vuelta a tus datos de origen.
El procesamiento por lotes de Claude actualmente admite los modelos Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Sonnet y Haiku en la API de Anthropic. Los clientes que usan Claude a través de Amazon Bedrock ya pueden utilizar la inferencia por lotes, y la compatibilidad con Google Cloud Vertex AI está en vista previa. Para los equipos que ejecutan canalizaciones con regularidad, las cuentas se acumulan: procesar 50 000 documentos al mes con un descuento del 50 % se traduce en miles de dólares ahorrados, haciendo que lo que antes no era económicamente viable ahora sea una práctica estándar.
Fuentes y créditos
Fuente original: Claude Platform Documentation & Anthropic Blog