全新HuggingFace数据集库发布!带来467种语言的611个文本数据集

??新智元报道??
??新智元报道??
来源:Huggingface
编辑:Q
【新智元导读】NLP初创公司 HuggingFace 近日发布新版其Datasets库 v1.2,包括611 个文本数据集,可以下载以准备在一行 python 中使用;涵盖 467 种语言,其中 99 种包含至少 10 个数据集;当使用非常大的数据集时(默认情况下是内存映射),高效的预处理可以使用户摆脱内存限制。




推荐阅读:


关注公众号:拾黑(shiheibook)了解更多
[广告]赞助链接:
四季很好,只要有你,文娱排行榜:https://www.yaopaiming.com/
让资讯触达的更精准有趣:https://www.0xu.cn/
关注网络尖刀微信公众号随时掌握互联网精彩
赞助链接
排名
热点
搜索指数
- 1 打好关键核心技术攻坚战 7904764
- 2 外交官辟谣:这是在中国 不是日本 7808240
- 3 售价约20元 水银温度计平替长这样 7712656
- 4 持续巩固增强经济回升向好态势 7619031
- 5 韩国硬刚高市早苗 7519748
- 6 生鲜灯不能两年都关不了 7428743
- 7 在南海坠毁的2架美国军机已被捞出 7334115
- 8 甲状腺癌为什么越来越常见 7237362
- 9 71岁的成龙回应“龙叔老了” 7137545
- 10 我国成功发射遥感四十七号卫星 7048999







新智元
