Text · dataset · 2026
Audio2Tool — Spoken Tool-Calling Benchmark
Listed in Hugging Face Datasets
Description
Audio2Tool: Speak, Call, Act — A Dataset for Benchmarking Speech Tool Use Authors: Ramit Pahwa1,∗,∗∗, Apoorva Beedu1,∗, Parivesh Priye1, Rutu Gandhi†1, Saloni Takawale†1, Aruna Baijal1, Zengli Yang1 1 Rivian & Volkswagen Technologies · ∗ equal contribution · ∗∗ corresponding author · † equal contribution 📄 Project page / demo: audio2tool.github.io/ 📦 Dataset: huggingface.co/datasets/RVtech/Audio2Tool ✉️ Contact (corresponding… See the full description on the dataset page: huggingface.co/datasets/RVtech/Audio2Tool.
Links
Where it is published
- Hugging Face dataset page huggingface.co/datasets/RVtech/Audio2Tool ↗
landing page · from Hugging Face
Catalogue records · 1
- Hub API huggingface.co/api/datasets/RVtech/Audio2Tool ↗
metadata API · from Hugging Face
Topics
- Stated by source
- audio · audio classification · audio text to text · automatic speech recognition · tabular · text · text generation
- From keywords
- Audio · Computer Science & AI
- Inferred from text
- Speech production 76%
Provenance · 1 source records, 17 field assertions
| Source | Key | Last seen | Raw |
|---|---|---|---|
| Hugging Face Datasets | RVtech/Audio2Tool | 8 d ago | JSON v1 |
| Field | Assertion | Extractor | Evidence |
|---|---|---|---|
| access_level | source · Hugging Face | connector:huggingface@1.0.0 | /gated |
| concepts[field].anzsrc:field:460211 | enrichment · Hugging Face | taxonomy-embedding@1.1.0 | title+keywords+description (76%) |
| concepts[field].local:field:computer-science-ai | mapping · Hugging Face | connector:huggingface@1.0.0 | |
| concepts[modality].hf_modality:audio | source · Hugging Face | connector:huggingface@1.0.0 | |
| concepts[modality].hf_modality:tabular | source · Hugging Face | connector:huggingface@1.0.0 | |
| concepts[modality].hf_modality:text | source · Hugging Face | connector:huggingface@1.0.0 | |
| concepts[modality].local:modality:audio | mapping · Hugging Face | vocabulary-mapper@1.0.0 | keywords['audio'] |
| concepts[task].hf_task:audio-classification | source · Hugging Face | connector:huggingface@1.0.0 | /tags[task_categories:*] |
| concepts[task].hf_task:audio-text-to-text | source · Hugging Face | connector:huggingface@1.0.0 | /tags[task_categories:*] |
| concepts[task].hf_task:automatic-speech-recognition | source · Hugging Face | connector:huggingface@1.0.0 | /tags[task_categories:*] |
| concepts[task].hf_task:text-generation | source · Hugging Face | connector:huggingface@1.0.0 | /tags[task_categories:*] |
| created_date | source · Hugging Face | connector:huggingface@1.0.0 | |
| description | source · Hugging Face | connector:huggingface@1.0.0 | /description |
| license | source · Hugging Face | connector:huggingface@1.0.0 | /tags[license:*] |
| publication_date | source · Hugging Face | connector:huggingface@1.0.0 | |
| title | source · Hugging Face | connector:huggingface@1.0.0 | /id |
| updated_date | source · Hugging Face | connector:huggingface@1.0.0 |