GPT4V-AD-Exploration
by PJLab-ADG
On the Road with GPT-4V(ision): Explorations of Utilizing Visual-Language Model as Autonomous Driving Agent
AI summary
Driving Model
An autonomous driving project exploring the capabilities of a visual-language model in understanding complex driving scenes and making decisions
- stars
- 288
- forks
- 15
- watching
- 11
Similar projects
Found by comparing what the projects do, not just their names.
Autonomous driving model
Reinforcement learning-based autonomous driving system
Driving Model
A multimodal language model designed to process video and text data for driving scenarios
Autonomous simulation platform
A platform for training and testing autonomous driving simulations using reinforcement learning
Region-of-Interest Training
Training and deploying large language models on computer vision tasks using region-of-interest inputs
Crop models
Developing large language models for agricultural applications to improve crop yields and support rural development.
Autonomous driving system
An autonomous driving system that performs real-time road segmentation, car detection, and street classification using deep learning models.
Conversational image interface
An intelligent system that enables automatic control and utilization of visual foundation models to interact with images in conversational settings.
vcciv/blvd171
Autonomous driving dataset
A large-scale 5D semantics benchmark for autonomous driving
Autonomous vehicle simulator
An autonomous vehicle modeling and control system using MATLAB and Simulink
Autonomous driving simulator
Enabling autonomous driving using deep reinforcement learning in a virtual environment
nvlabs/edm1.4K
Generative model framework
This project provides a set of tools and techniques to design and improve diffusion-based generative models.
Autonomous vehicle research platform
Research platform for developing autonomous vehicles using computer vision and machine learning techniques
nvlabs/prismer1.3K
Vision-Language Model
A deep learning framework for training multi-modal models with vision and language capabilities.
VLIT model toolkit
A comprehensive dataset and evaluation framework for Vision-Language Instruction Tuning models
Autonomous driving notes
A personal collection of notes on decision-making techniques for autonomous driving research