数据抽样热门博客列表 - ITeye博客频道

博客专栏推荐

本月博客排行

第1名
wy_19921005
第2名
mft8899
第3名
java-007
Anmin
benladeng5225

年度博客排行

使用awk和grep进行数据抽样比较

在进行数据抽样时，我们关注所抽取的数据在整体数据中分布的均匀性。最简单的就是均匀抽取，即每隔几行选取一行。比如，数据文件较大时，每隔10行或者每隔100行进行抽取。假如数据文件还是“msg” 我们每隔10行取一行，有两种方法：方法1：nl+grep nl msg | grep -P '1\t' > target_file 方法2：awk ...

grep awk nl 数据抽样

liuzhiqiangruc 评论(0) 有7990人浏览 2011-11-21 22:11

最近博客热门TAG

Java(141741) C(73643) C++(68602) SQL(64557) C#(59604) XML(59131) HTML(59042) JavaScript(54916) .net(54782) Web(54511) 工作(54116) Linux(50906) Oracle(49861) 应用服务器(43285) Spring(40811) 编程(39452) Windows(39380) JSP(37540) MySQL(37266) 数据结构(36420)

博客人气排行榜

博客电子书下载排行

>>浏览更多下载