[BMVC 2026] DocAttriBench: Benchmarking Answer Grounding in Document Visual Question Answering
AI & ML interests
None defined yet.
Recent Activity
Papers
Mind the Heads: Topological Representation Alignment for Multimodal LLMs
ReAG: Reasoning-Augmented Generation for Knowledge-based Visual Question Answering
models 55
aimagelab/HeRA_GranD
Updated
aimagelab/HeRA-Llama3-8B-SigLIP2
9B • Updated • 7
aimagelab/HeRA-Qwen3-8B-SigLIP2
9B • Updated • 4
aimagelab/HeRA-Qwen3-4B-SigLIP2
5B • Updated • 4 • 1
aimagelab/HeRA-Qwen2.5-7B-SigLIP2
8B • Updated • 6 • 1
aimagelab/HeRA-Qwen2.5-3B-SigLIP2
4B • Updated • 7 • 1
aimagelab/ReAG-Critic
Image-Text-to-Text • 756k • Updated • 83
aimagelab/ReAG-3B
Image-Text-to-Text • 4B • Updated • 27 • 1
aimagelab/ReAG-7B
Image-Text-to-Text • 8B • Updated • 13
aimagelab/vhs-checkpoints
Updated
datasets 8
aimagelab/DocAttriBench
Viewer • Updated • 286k
aimagelab/vhs-checkpoints
Updated • 44
aimagelab/ReT-M2KR
Preview • Updated • 8.43k • 2
aimagelab/CHAIR-DPO_preference_datasets
Viewer • Updated • 1.39M • 76
aimagelab/HeisenVec
Viewer • Updated • 935k • 304 • 3
aimagelab/RAID
Preview • Updated • 3.44k • 2
aimagelab/ReflectiVA-Data
Preview • Updated • 77
aimagelab/ViSU-Text
Viewer • Updated • 169k • 11 • 10