Constarium
← Search

Data · dataset · 2025

VLM2Vec/MMEB-V2

Listed in Hugging Face Datasets

Description

MMEB-V2 (Massive Multimodal Embedding Benchmark) Building upon on our original MMEB, MMEB-V2 expands the evaluation scope to include five new tasks: four video-based tasks — Video Retrieval, Moment Retrieval, Video Classification, and Video Question Answering — and one task focused on visual documents, Visual Document Retrieval. This comprehensive suite enables robust evaluation of multimodal embedding models across static, temporal, and structured visual data settings.

This Hugging… See the full description on the dataset page: huggingface.co/datasets/VLM2Vec/MMEB-V2.

Links

Where it is published

Documentation and papers

Catalogue records · 1

Topics

Provenance · 1 source records, 12 field assertions
SourceKeyLast seenRaw
Hugging Face DatasetsVLM2Vec/MMEB-V212 d agoJSON v1
FieldAssertionExtractorEvidence
access_levelsource · Hugging Faceconnector:huggingface@1.0.0/gated
concepts[field].anzsrc:group:4603enrichment · Hugging Facetaxonomy-embedding@1.1.0title+keywords+description (70%)
concepts[field].local:field:computer-science-aimapping · Hugging Faceconnector:huggingface@1.0.0
concepts[modality].local:modality:videoenrichment · Hugging Facekeyword-concept-rules@1.0.0title+description (75%)
concepts[task].hf_task:video-classificationsource · Hugging Faceconnector:huggingface@1.0.0/tags[task_categories:*]
concepts[task].hf_task:visual-question-answeringsource · Hugging Faceconnector:huggingface@1.0.0/tags[task_categories:*]
created_datesource · Hugging Faceconnector:huggingface@1.0.0
descriptionsource · Hugging Faceconnector:huggingface@1.0.0/description
licensesource · Hugging Faceconnector:huggingface@1.0.0/tags[license:*]
publication_datesource · Hugging Faceconnector:huggingface@1.0.0
titlesource · Hugging Faceconnector:huggingface@1.0.0/id
updated_datesource · Hugging Faceconnector:huggingface@1.0.0