साधारण OCR से अधिक की ज़रूरत हो, तो Parse endpoint उपयोग करें। यह pages का क्रम बनाए रखता है और Markdown या text, image तथा table के structured blocks लौटा सकता है।
Cohere का public Parse API अभी केवल image URLs और base64 image data URIs स्वीकार करता है। भेजने से पहले PDF pages को images में बदलें। हर image 20 MB, 50 megapixels या decode होने के बाद 200 MB से बड़ी नहीं होनी चाहिए।
Markdown में पार्स करें
Markdown में पढ़ने का क्रम बना रहता है, tables HTML के रूप में आती हैं और पहचानी गई images पेज के metadata से जुड़ती हैं।
संरचित ब्लॉक लौटाएँ
output_format को blocks सेट करें, ताकि क्रमबद्ध text, image और table regions मिलें। उपलब्ध होने पर image और table blocks में pixel और normalized bounding boxes शामिल होते हैं।
Parse usage प्रति page मापा जाता है। Provider के billed pages बताने पर response में Cohere metadata और normalized usage.input_pages value शामिल होती है। Cohere अभी evaluation के लिए rate-limited API access मुफ़्त देता है और उसने Parse की production दर प्रकाशित नहीं की है।