GitHub - dill-lab/vlm-quality-scores

Code for the paper Believing without Seeing: Quality Scores for Contextualizing Vision-Language Model Explanations (https://arxiv.org/abs/2509.25844)

Setup

Init submodules:

git submodule update --init --recursive

Create and activate a virtual environment, then install deps:

python3 -m venv .venv && source .venv/bin/activate
pip install -r requirements.txt

Configure environment variables:

OPENAI_API_KEY: Your OpenAI API key.
VLMQS_DATASETS_DIR: Path to datasets dir (default: data/).
VLMQS_OUTPUTS_DIR: Path to outputs dir (default: model_outputs/).
VLMQS_COST_FILE: Path to track API costs (default: total_cost.txt).

Data preparation

Download subsets and materialize CSVs and images:

python3 load_dataset.py --dataset all

This creates data/AOKVQA/AOKVQA.csv and data/VizWiz/VizWiz.csv with local image paths.

Inference

Generate predictions and rationales. Example (all models, both datasets):

python3 vqa_infer.py --dataset all --model all --rewrite_file

Outputs will be saved under model_outputs/<DATASET>/<MODEL>.csv.

For a quick test run (20 samples):

python3 vqa_infer.py --dataset VizWiz --model qwen --test --rewrite_file

Rationale quality analyses

Run support/contrastiveness, visual fidelity, informativeness, and commonsense:

python3 rationale_quality_analysis.py --dataset all --quality all

This updates each model_outputs/<DATASET>/<MODEL>.csv with new columns.

Name		Name	Last commit message	Last commit date
Latest commit History 10 Commits
ece_analysis_results		ece_analysis_results
lave @ 253640b		lave @ 253640b
model_outputs		model_outputs
.gitignore		.gitignore
.gitmodules		.gitmodules
LICENSE		LICENSE
README.md		README.md
commonsense_analysis.py		commonsense_analysis.py
ece_analysis.py		ece_analysis.py
globals.py		globals.py
informativeness_analysis.py		informativeness_analysis.py
lavegpt.py		lavegpt.py
lm_loader.py		lm_loader.py
load_dataset.py		load_dataset.py
rationale_quality_analysis.py		rationale_quality_analysis.py
requirements.txt		requirements.txt
run_aokvqa_openset_ablation.py		run_aokvqa_openset_ablation.py
run_logits_baselines.py		run_logits_baselines.py
support_contrastiveness_analysis.py		support_contrastiveness_analysis.py
utils.py		utils.py
visual_fidelity.py		visual_fidelity.py
vqa_infer.py		vqa_infer.py

Provide feedback

Saved searches

Use saved searches to filter your results more quickly

Repository files navigation

Code for the paper Believing without Seeing: Quality Scores for Contextualizing Vision-Language Model Explanations (https://arxiv.org/abs/2509.25844)

Setup

Data preparation

Inference

Rationale quality analyses

About

Uh oh!

Releases

Packages

Uh oh!

Contributors

Uh oh!

Languages

Folders and files

Latest commit

History

Repository files navigation

Code for the paper Believing without Seeing: Quality Scores for Contextualizing Vision-Language Model Explanations (https://arxiv.org/abs/2509.25844)

Setup

Data preparation

Inference

Rationale quality analyses

About

Resources

License

Uh oh!

Stars

Watchers

Forks

Releases

Packages 0

Uh oh!

Contributors

Uh oh!

Languages

Packages