Media & documents
OCR + vLLM evidence
इमेज उत्तरों को OCR और मॉडल व्याख्या दोनों में ग्राउंड करें।
इमेज उत्तरों को OCR और मॉडल व्याख्या दोनों में ग्राउंड करें:
Arka रिपोर्ट करता है कि OCR क्या कहता है, visual/vLLM मॉडल क्या कहता है, और एक संयुक्त उत्तर जो agreement, conflicts, और uncertainty की पहचान करता है। यह चुपचाप किसी मॉडल guess को text evidence के रूप में नहीं मानता। प्राकृतिक भाषा अनुरोध समर्थित हैं।
संबंधित विषय
Image description, OCR, और screen capturevLLM fallbackDev work के लिए video evidenceAI agent guide — MCP पर Arka उपयोग करेंpytest suite के साथ Arka का Testing