TouchStone
by OFA-Sys
Touchstone: Evaluating Vision-Language Models by Language Models
AI summary
Vision Model Evaluator
A tool to evaluate vision-language models by comparing their performance on various tasks such as image recognition and text generation.
- stars
- 79
- forks
- 0
- watching
- 3
Similar projects
Found by comparing what the projects do, not just their names.
Model Evaluator
Evaluates language models using standardized benchmarks and prompting techniques.
Model Evaluator
An evaluation framework for machine learning models and datasets, providing standardized metrics and tools for comparing model performance.
Evaluation pipeline
A framework for evaluating language models on NLP tasks
Multimodal model evaluator
An open-source benchmark and evaluation tool for assessing multimodal large language models' performance in embodied decision-making tasks
Model evaluator
A tool for evaluating and visualizing machine learning model performance
Evaluation framework
An evaluation toolkit for large vision-language models
Model evaluator
A framework for efficiently evaluating and benchmarking large models
Video model evaluator
A benchmark suite for evaluating the performance of video generative models
Image evaluator
Assesses and evaluates images using deep learning models
tsb0601/mmvp296
Visual model evaluation
An evaluation framework for multimodal language models' visual capabilities using image and question benchmarks.
Multimodal evaluation framework
Develops a multimodal task and dataset to assess vision-language models' ability to handle interleaved image-text inputs.
Vision model safety test
A benchmark for evaluating the safety and robustness of vision language models against adversarial attacks.
Model Evaluator
A benchmarking framework for evaluating Large Multimodal Models by providing rigorous metrics and an efficient evaluation pipeline.
LLM evaluator
An all-in-one toolkit for evaluating Large Language Models (LLMs) across multiple backends.
Vision-Language Model Trainer
This is an open-source project that proposes a novel method to train large-scale vision-language models with minimal resources and no fine-tuning required.