最新文章列表

使用awk和grep进行数据抽样比较

在进行数据抽样时,我们关注所抽取的数据在整体数据中分布的均匀性。 最简单的就是均匀抽取,即每隔几行选取一行。 比如,数据文件较大时,每隔10行或者每隔100行进行抽取。   假如数据文件还是“msg” 我们每隔10行取一行,有两种方法:   方法1:nl+grep   nl msg | grep -P '1\t' > target_file   方法2:awk   ...
liuzhiqiangruc 评论(0) 有7938人浏览 2011-11-21 22:11

最近博客热门TAG

Java(141747) C(73651) C++(68608) SQL(64571) C#(59609) XML(59133) HTML(59043) JavaScript(54918) .net(54785) Web(54513) 工作(54116) Linux(50906) Oracle(49876) 应用服务器(43288) Spring(40812) 编程(39454) Windows(39381) JSP(37542) MySQL(37268) 数据结构(36423)

博客人气排行榜

    博客电子书下载排行

      >>浏览更多下载

      相关资讯

      相关讨论

      Global site tag (gtag.js) - Google Analytics