首页 人工智能 深度学习     /    ag_news文天职类数据集

ag_news文天职类数据集

上传者: weixin_42447890 | 上传时间:2021/8/6 15:37:10 | 文件大小:11.25MB | 文件类型:zip
ag_news文天职类数据集
AG'sNewsTopicClassificationDatasetVersion3,Updated09/09/2015ORIGINAGisacollectionofmorethan1millionnewsarticles.Newsarticleshavebeengatheredfrommorethan2000newssourcesbyComeToMyHeadinmorethan1yearofactivity.ComeToMyHeadisanacademicnewssearchenginewhichhasbeenrunningsinceJuly,2004.Thedatasetisprovidedbytheacademiccomunityforresearchpurposesindatamining(clustering,classification,etc),informationretrieval(ranking,search,etc),xml,datacompression,datastreaming,andanyothernon-commercialactivity.Formoreinformation,pleaserefertothelinkhttp://www.di.unipi.it/~gulli/AG_corpus_of_news_articles.html.TheAG'snewstopicclassificationdatasetisconstructedbyXiangZhang(xiang.zhang@nyu.edu)fromthedatasetabove.Itisusedasatextclassificationbenchmarkinthefollowingpaper:XiangZhang,JunboZhao,YannLeCun.Character-levelConvolutionalNetworksforTextClassification.AdvancesinNeuralInformationProcessingSystems28(NIPS2015).DESCRIPTIONTheAG'snewstopicclassificationdatasetisconstructedbychoosing4largestclassesfromtheoriginalcorpus.Eachclasscontains30,000trainingsamplesand1,900testingsamples.Thetotalnumberoftrainingsamplesis120,000andtesting7,600.Thefileclasses.txtcontainsalistofclassescorrespondingtoeachlabel.Thefilestrain.csvandtest.csvcontainallthetrainingsamplesascomma-sparatedvalues.Thereare3columnsinthem,correspondingtoclassindex(1to4),titleanddescription.Thetitleanddescriptionareescapedusingdoublequotes("),andanyinternaldoublequoteisescapedby2doublequotes("").Newlinesareescapedbyabackslashfollowedwithan"n"character,thatis"\n".

文件下载

资源详情

[{"title":"(2个子文件11.25MB)ag_news文本分类数据集","children":[{"title":"test.csv <span style='color:#111;'>1.77MB</span>","children":null,"spread":false},{"title":"train.csv <span style='color:#111;'>28.11MB</span>","children":null,"spread":false}],"spread":true}]

评论信息

免责申明

【好快吧下载】的资源来自网友分享,仅供学习研究,请务必在下载后24小时内给予删除,不得用于其他任何用途,否则后果自负。基于互联网的特殊性,【好快吧下载】 无法对用户传输的作品、信息、内容的权属或合法性、合规性、真实性、科学性、完整权、有效性等进行实质审查;无论 【好快吧下载】 经营者是否已进行审查,用户均应自行承担因其传输的作品、信息、内容而可能或已经产生的侵权或权属纠纷等法律责任。
本站所有资源不代表本站的观点或立场,基于网友分享,根据中国法律《信息网络传播权保护条例》第二十二条之规定,若资源存在侵权或相关问题请联系本站客服人员,8686821#qq.com,请把#换成@,本站将给予最大的支持与配合,做到及时反馈和处理。关于更多版权及免责申明参见 版权及免责申明