Skip to main content
इमेज उत्तरों को OCR और मॉडल व्याख्या दोनों में ग्राउंड करें:
Arka रिपोर्ट करता है कि OCR क्या कहता है, visual/vLLM मॉडल क्या कहता है, और एक संयुक्त उत्तर जो agreement, conflicts, और uncertainty की पहचान करता है। यह चुपचाप किसी मॉडल guess को text evidence के रूप में नहीं मानता। प्राकृतिक भाषा अनुरोध समर्थित हैं।