HallusionBench
by tianyi-lab
Pythonpushed almost 2 years ago
[CVPR'24] HallusionBench: You See What You Think? Or You Think What You See? An Image-Context Reasoning Benchmark Challenging for GPT-4V(ision), LLaVA-1.5, and Other Multi-modality Models
AI summary
Benchmark
An image-context reasoning benchmark designed to challenge large vision-language models and help improve their accuracy
- stars
- 259
- forks
- 7
- watching
- 4