Reupload
होम पर वापस जाएं

Skill · Claude Platform Documentation & Anthropic Blog

Claude Batch API से 50% छूट पर थोक डेटा प्रोसेस करें

Claude Batch API से 50% छूट पर थोक डेटा प्रोसेस करें

फोटो: Taylor Vick Unsplash पर

Claude की Batch API 24 घंटे से कम समय में अधिकतम 10,000 अनुरोधों को असिंक्रोनस रूप से संसाधित करती है, और वह भी सामान्य लागत के ठीक आधे पर। यह बड़े डेटासेट के विश्लेषण, सपोर्ट टिकटों के वर्गीकरण या दस्तावेज़ भंडारों के प्रसंस्करण के लिए एकदम उपयुक्त है जहां रीयल-टाइम प्रतिक्रियाएं जरूरी नहीं होतीं-महंगी एक-एक करके की जाने वाली API कॉल्स को किफायती थोक संचालनों में बदल देती है।

Batch API विशेष रूप से उन गैर-समय-संवेदनशील कार्यभारों के लिए बनाई गई है जहां लेटेंसी से ज्यादा लागत मायने रखती है। ऐसी व्यक्तिगत API कॉल्स करने के बजाय जो आपसे प्रति-अनुरोध शुल्क लेती हैं, आप अधिकतम 10,000 अनुरोधों वाली एक बैच फ़ाइल जमा करते हैं, और Claude उन सबको असिंक्रोनस रूप से संसाधित करके नतीजे थोक में लौटा देता है-इनपुट और आउटपुट दोनों टोकनों के लिए मानक मूल्य निर्धारण के 50% पर। एक बैच पूरा होने में 24 घंटे से कम समय लेता है, जिससे यह रात भर चलने वाली प्रोसेसिंग पाइपलाइनों के लिए आदर्श बन जाता है।

व्यावहारिक अनुप्रयोग: कल्पना करें कि एक कस्टमर सक्सेस टीम को सामान्य शिकायत श्रेणियों की पहचान करने, प्रतिक्रियाएं सुझाने और प्राथमिकता स्तरों को टैग करने के लिए 2,000 सपोर्ट टिकटों का विश्लेषण करना है। मानक दरों पर हर टिकट को अलग-अलग API से गुजारने पर 500 डॉलर का खर्च आएगा। वही 2,000 टिकट एक ही बैच के रूप में संसाधित करने पर 250 डॉलर का खर्च आता है। आप शाम 5 बजे बैच जमा करते हैं, अगले दिन सुबह 9 बजे तक नतीजे मिल जाते हैं, और आपके नतीजे स्टैंडअप में टीम समीक्षा के लिए तैयार होते हैं। बड़े पैमाने पर दस्तावेज़ संसाधित करने वाली टीमों के लिए-त्रैमासिक रिपोर्टों का विश्लेषण, अनुबंधों से डेटा निकालना, या कोड भंडारों की समीक्षा-Batch API विश्लेषण को आर्थिक रूप से व्यवहार्य बना देती है।

कार्यप्रवाह सीधा है: अपने अनुरोधों को JSONL फ़ाइल के रूप में तैयार करें (प्रति पंक्ति एक अनुरोध), अपनी फ़ाइल के साथ batches एंडपॉइंट को कॉल करें, एक बैच आईडी प्राप्त करें, और पूर्णता के लिए पोल करें। API स्वतः पुनःप्रयास संभालती है, जिसमें थ्रॉटल किए गए अनुरोध भी शामिल हैं, इसलिए आपको मैन्युअल पुनःप्रयास प्रबंधित करने की जरूरत नहीं है। आउटपुट आपके इनपुट के समान क्रम में लौटाया जाता है, जिससे नतीजों को आपके स्रोत डेटा से जोड़ना आसान हो जाता है।

Claude की बैच प्रोसेसिंग वर्तमान में Anthropic API पर Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Sonnet और Haiku मॉडलों का समर्थन करती है। Amazon Bedrock के जरिए Claude का उपयोग करने वाले ग्राहक पहले से ही बैच इन्फरेंस का उपयोग कर सकते हैं, और Google Cloud Vertex AI समर्थन प्रीव्यू में है। नियमित रूप से पाइपलाइन चलाने वाली टीमों के लिए गणित जुड़ता जाता है: 50% छूट पर प्रति माह 50,000 दस्तावेज़ संसाधित करने से हज़ारों डॉलर की बचत होती है, जिससे जो पहले अलाभकारी था वह अब मानक प्रथा बन जाता है।

स्रोत और क्रेडिट

मूल स्रोत: Claude Platform Documentation & Anthropic Blog