PCA-EVAL
by pkunlp-icler
Jupyter Notebookpushed over 2 years ago
[ACL 2024] PCA-Bench: Evaluating Multimodal Large Language Models in Perception-Cognition-Action Chain
AI summary
Multimodal model evaluator
An open-source benchmark and evaluation tool for assessing multimodal large language models' performance in embodied decision-making tasks
- stars
- 99
- forks
- 3
- watching
- 5