我有一个带通信密钥的文件 – >值:
sort keyFile.txt | head ENSMUSG00000000001 ENSMUSG00000000001_Gnai3 ENSMUSG00000000003 ENSMUSG00000000003_Pbsn ENSMUSG00000000003 ENSMUSG00000000003_Pbsn ENSMUSG00000000028 ENSMUSG00000000028_Cdc45 ENSMUSG00000000028 ENSMUSG00000000028_Cdc45 ENSMUSG00000000028 ENSMUSG00000000028_Cdc45 ENSMUSG00000000031 ENSMUSG00000000031_H19 ENSMUSG00000000031 ENSMUSG00000000031_H19 ENSMUSG00000000031 ENSMUSG00000000031_H19 ENSMUSG00000000031 ENSMUSG00000000031_H19
我想用temp.txt中的“value”替换“key”的每个对应关系:
head temp.txt ENSMUSG00000000001:001 515 ENSMUSG00000000001:002 108 ENSMUSG00000000001:003 64 ENSMUSG00000000001:004 45 ENSMUSG00000000001:005 58 ENSMUSG00000000001:006 63 ENSMUSG00000000001:007 46 ENSMUSG00000000001:008 11 ENSMUSG00000000001:009 13 ENSMUSG00000000003:001 0
结果应该是:
out.txt ENSMUSG00000000001_Gnai3:001 515 ENSMUSG00000000001_Gnai3:002 108 ENSMUSG00000000001_Gnai3:003 64 ENSMUSG00000000001_Gnai3:004 45 ENSMUSG00000000001_Gnai3:005 58 ENSMUSG00000000001_Gnai3:006 63 ENSMUSG00000000001_Gnai3:007 46 ENSMUSG00000000001_Gnai3:008 11 ENSMUSG00000000001_Gnai3:009 13 ENSMUSG00000000001_Gnai3:001 0
我在this AWK example之后尝试了一些变化但是你可以看到结果不是我的预期:
awk 'NR==FNR{a[$1]=$1;next}{$1=a[$1];}1' keyFile.txt temp.txt | head 515 108 64 45 58 63 46 11 13 0
我的猜测是temp的第1列与keyValues的’确切’第1列不匹配.有人可以帮我这个吗?
R / python / sed解决方案也很受欢迎.
解决方法
像这样使用awk命令:
awk 'NR==FNR {a[$1]=$2;next} { split($1,b,":"); if (b[1] in a) print a[b[1]] ":" b[2],$2; else print $0; }' keyFile.txt temp.txt