Constarium
← Search

Imaging · dataset · 2026

DBbun/motoman-up6-cq-lambda-reinforcement-learning_v1.0

Listed in Hugging Face Datasets

CQ(λ) Bag-Shaking Dataset: Human-in-the-Loop Reinforcement Learning Dataset Description This dataset contains synthetic training data comparing standard Q-learning with eligibility traces [Q(λ)] against Cooperative Q-learning [CQ(λ)], a human-in-the-loop reinforcement learning algorithm.

Description

The data simulates a robotic "bag-shaking" task where an agent must extract knotted objects from a bag through strategic shaking motions.

Dataset

Read the rest (2 more)

Summary

Task: Bag-shaking… See the full description on the dataset page: huggingface.co/datasets/DBbun/motoman-up6-cq-lambda-reinforcement-learning_v1.0.

Links

Topics

Stated by source
image
Provenance · 1 source records, 9 field assertions
SourceKeyLast seenRaw
Hugging Face DatasetsDBbun/motoman-up6-cq-lambda-reinforcement-learning_v1.012 d agoJSON v1
FieldAssertionExtractorEvidence
access_levelsource · Hugging Faceconnector:huggingface@1.0.0/gated
concepts[field].local:field:computer-science-aimapping · Hugging Faceconnector:huggingface@1.0.0
concepts[modality].hf_modality:imagesource · Hugging Faceconnector:huggingface@1.0.0
created_datesource · Hugging Faceconnector:huggingface@1.0.0
descriptionsource · Hugging Faceconnector:huggingface@1.0.0/description
licensesource · Hugging Faceconnector:huggingface@1.0.0/tags[license:*]
publication_datesource · Hugging Faceconnector:huggingface@1.0.0
titlesource · Hugging Faceconnector:huggingface@1.0.0/id
updated_datesource · Hugging Faceconnector:huggingface@1.0.0