Skip to main content

FairVLMed: Fair Vision-Language Medical Ophthalmic Dataset

10,000 scanning-laser ophthalmoscopy fundus images paired with de-identified clinical notes, visual-field measurements, glaucoma labels, and demographic attributes.

At a glance

FieldValue
Short namefairvlmed
Full nameFairVLMed: Fair Vision-Language Medical Ophthalmic Dataset
First publishedUnknown
Publication date precisionUnknown
Publication date evidenceUnknown
Publication date source fieldUnknown
Publication date reviewedUnknown
Primary categorymultimodal
Resource rolecurrent_dataset
Dataset familyfairvlmed
Contained modalitiesfundus, visual_field, text, tabular
Tasksclassification, report_generation, fairness_analysis
Primary reported quantity10,000 images
ClassesNot reported (Not reported)
Splitstrain, val, test
Size10.0 GB
Source-stated termsCC BY-NC-ND 4.0
Normalized termscc-by-nc-nd
Descriptive screening labelExplicit noncommercial clause recorded; check source
Terms scopedataset_files
Access frictionself_service_authenticated
Route backendHuggingFace Hub
Availabilityavailable (checked 2026-07-21)
Acquisition supportstandard_platform_supported
Legacy sample-loader statusMetadata and access only

Reported quantities

RoleCountUnitScopeBasisEvidence
Primary10,000imagesPrimary quantity reported in the reviewed catalog sourcelegacy_catalog_fieldhuggingface.co/datasets

Counts retain their source-reported units. Additional rows can describe components, paired items, or derivative copies and are not automatically added to the primary quantity.

Notes

The official dataset card reports 10,000 patients and 10,000 samples (7,000 train, 1,000 validation, 2,000 test). No source statement supporting cohort identity with the separate Harvard-FairVision record was found, so no catalog relationship is asserted.

Access information and download

# Read-only preflight
eyehub download fairvlmed --data-dir ./data --dry-run --json

# Download, only when preflight reports supported behavior
eyehub download fairvlmed --data-dir ./data

Upstream page: huggingface.co/datasets

Source-term evidence: huggingface.co/datasets

Loader status

This catalog record provides metadata and access instructions, but it does not yet include a standard DatasetSample loader. Inspect the source file structure or contribute a loader before using it in a training pipeline.

Citation

@misc{fairvlmed,
title = { FairVLMed: Fair Vision-Language Medical Ophthalmic Dataset },
note = { Harvard AI Robotics, FairVLMed: Fair vision-language medical ophthalmic dataset. HuggingFace, 2024 },
year = { 2024 },
url = { https://huggingface.co/datasets/harvardairobotics/FairVLMed },
}

Source-stated terms

  • Raw source string: CC BY-NC-ND 4.0
  • Normalized category: cc-by-nc-nd
  • Apparent scope: dataset_files
  • Descriptive screening label: Explicit noncommercial clause recorded; check source

⚠️ Source-stated terms, scope, and normalized labels are curation metadata, not legal advice or a permission finding. Review the current official source before transfer or reuse.

Similar resources by shared modality

  • lmod_plus: LMOD+ Multimodal Ophthalmology Benchmark (32,633 annotated instances, unknown)
  • grape: GRAPE: Glaucoma Real-world Appraisal Progression Ensemble (1,115 examinations, cc0)
  • ocular_chat_vqa: OcularChat-VQA: AREDS-Derived Patient-Physician Dialogue Dataset (844,000 records, cc-by-nc-sa)
  • eyecare_100k: Eyecare-100K: Multimodal Ophthalmology VQA Corpus (102,000 question answer pairs, unknown)
  • angioreport: AngioReport Fundus Angiography Report Dataset (55,361 images, unknown)
  • ffa_ir: FFA-IR Medical Report Dataset (47,247 images, unknown)
  • x_pcr: X-PCR Ophthalmology Progressive Clinical Reasoning Benchmark (18,735 rows, unknown)
  • deepeyenet: DeepEyeNet (DEN): Fundus Report Generation Dataset (15,709 images, research-only)