MultimodalOCR
by Yuliang-Liu
On the Hidden Mystery of OCR in Large Multimodal Models (OCRBench)
AI summary
OCR Benchmark
An evaluation benchmark for OCR capabilities in large multmodal models.
- stars
- 484
- forks
- 32
- watching
- 15
Similar projects
Found by comparing what the projects do, not just their names.
Multimodal benchmarking
Evaluates and benchmarks multimodal language models' ability to process visual, acoustic, and textual inputs simultaneously.
Image captioner
An end-to-end image captioning system that uses large multi-modal models and provides tools for training, inference, and demo usage.
Multimodal LLM test suite
A benchmark for evaluating large language models' ability to process multimodal input
Multimodal model evaluator
Evaluating and improving large multimodal models through in-context learning
Learning benchmark
A benchmarking suite for multimodal in-context learning models
Chinese understanding benchmark
Measures the understanding of massive multitask Chinese datasets using large language models
Benchmarking tool
Evaluates Ontology-Based Data Access systems with inference and meta knowledge benchmarking
AutoML benchmarking framework
A framework for evaluating and comparing machine learning pipelines and neural architectures.
LLM benchmarker
A benchmarking framework for large language models
Visual Model Benchmark
An open-source benchmarking framework for evaluating cross-style visual capability of large multimodal models
Model evaluator
Evaluates the capabilities of large multimodal models using a set of diverse tasks and metrics
ML Model Benchmarker
Provides a benchmarking framework and dataset for evaluating the performance of large language models in text-to-image tasks
Multimodal model evaluator
An open-source benchmark and evaluation tool for assessing multimodal large language models' performance in embodied decision-making tasks
Model Evaluator
A benchmarking framework for evaluating Large Multimodal Models by providing rigorous metrics and an efficient evaluation pipeline.
Chart model trainer
Develops a large-scale dataset and benchmark for training multimodal chart understanding models using large language models.