所以連續技:
$ du -hd1
...
13M ./Cache
552M ./Uploads
340K ./css
1GB .
$ du -hd1 | sort -h
...
340K ./css
13M ./Cache
552M ./Uploads
1GB .
$ du -hd1
...
13M ./Cache
552M ./Uploads
340K ./css
1GB .
$ du -hd1 | sort -h
...
340K ./css
13M ./Cache
552M ./Uploads
1GB .
$ cat data_set.input
[
{ "field1":"1" , "field2": "2", "field3": 3, "field4" : [1, 2, 3] } ,
{ "field1":"a" , "field2": "b", "field3": 4, "field4" : [1, 2] } ,
...
}
$ < data_set.file jq '.[] | .field1 +"-" + .field2 '
"1-2"
"a-b"
...
$ < data_set.input jq '.[] | .field1 +"-" + (.field3 | tostring) '
"1-3"
"a-4"
...
$ < data_set.input jq '.[] | .field1 +"-" + (.field4 | length | tostring) '
"1-3"
"a-2"
...
$ < data_set.file jq '.[] | .field1 +"-" + .field2 ' | awk -F'"' '{print $2}'
1-2
a-b
...
$ < data_set.file awk -F'-' '{ if($2 > 10) { print $1 }}'
$ < data_set.file awk -F'-' '{ if($2 > 10) { print $1 }}' | sort | uniq
$ < data_set.file awk -F'-' '{ if($2 > 10) { print $1 }}' | sort | uniq -c | sort -n
$ < data_set.file awk -F'-' '{ if($2 > 10) { print $1 }}' | sort | uniq -c | sort -n | tail -n +1234
$ < data_set.file awk -F'-' '{ if($2 > 10) { print $1 }}' | sort | uniq -c | sort -n | tail -n +1234 | awk -F ' ' '{print $2}'
$ sort lookup_pattern > lookup_pattern.sorted
$ sort check_data > check_data.sorted
$ diff lookup_pattern.sorted check_data.sorted | grep "<"
$ diff lookup_pattern.sorted check_data.sorted | grep -c "<"
$ comm -1 -2 lookup_pattern.sorted check_data.sorted
#!/usr/bin/python
#
# input.log、p1.log、p2.log 都是以 line 為單位的資料
#
in_data = open('input.log').read().split("\n")
pattern_data1 = open('p1.log').read().split("\n")
pattern_data2 = open('p2.log').read().split("\n")
lookup1 = {}
for i in pattern_data1:
lookup1[i] = ''
lookup2 = {}
for i in pattern_data2:
lookup2[i] = ''
for i in in_data:
if i in lookup1:
print " data in lookup1"
elif i in lookup2:
print " data in lookup2 && not in lookup1"