Few-NERD is a large-scale, fine-grained manually annotated named entity recognition dataset, which contains 8 coarse-grained types, 66 fine-grained types, 188,200 sentences, 491,711 entities, and 4,60
瑞金糖尿病NER+ER数据集
《知网》情感分析常用词语集,包括情感、评价、程度级别、主张词语,全部分正负面以及中英文;
从微博中爬取了80页,大概有1200多条评论数据。数据已经清理成纯文本。
唐诗的CSV格式
2020年草案
某评分网站视频短评之数据集
此数据集的测量值代表声纳接收器在不同地点接收到的返回信号
包含来自六个不同国家/地区的演讲者阅读的单个英语单词,用于口音检测和识别
此数据集也是他职业生涯中的一项重大成就,该数据库包含大约2000条记录,记录了60多种海洋哺乳动物,并带有超过15,000个注释好的数字声音片段,这些记录具有巨大的历史和科学价值。
现状4个人, 2000次录音(每名发言者50次)
类别包括89到110个样本;每个样品5-10秒。