Flickr Audio Caption Corpus #70

michizhou · 2021-10-27T07:19:11Z

About Dataset: The Flickr 8k Audio Caption Corpus contains 40,000 spoken captions of 8,000 natural images. It was collected in 2015 to investigate multimodal learning schemes for unsupervised speech pattern discovery. This corpus only includes audio recordings, and not the original text captions or associated images.

michizhou mentioned this issue Oct 31, 2021

Flickr-Audio-Caption-Corpus Added #78

Merged

5 tasks

Provide feedback

Saved searches

Use saved searches to filter your results more quickly

Flickr Audio Caption Corpus #70

Flickr Audio Caption Corpus #70

michizhou commented Oct 27, 2021

Flickr Audio Caption Corpus #70

Flickr Audio Caption Corpus #70

Comments

michizhou commented Oct 27, 2021