
次のようなテキスト ファイルがあります。
UICEX_0001 UICEX_0001_T1.bam UICEX_0001_C2.bam chr1:16946335 chr19:9064309 chr8:10480278
UICEX_0003 UICEX_0003_T1.bam UICEX_0003_C2.bam chr1:16974893
この情報を使用して、文字列を結合し、テキスト ファイルから情報を動的に入力して、次のようなものを作成しようとしています。次の操作を実行したいです。
- 各行をループする
- 最初の3列を変数に割り当てる
- これらの変数を使ってテキストを印刷する
- 次に4番目の列をループします
- 何か特定のものを印刷します。
出力ファイルの例を次に示します。
出力ファイル
load UICEX_0001_T1.bam
load UICEX_0001_C2.bam
goto chr1:16946335
collapse
snapshot UICEX_0001_chr1:16946335.png
goto chr19:9064309
collapse
snapshot UICEX_0001_chr19:9064309.png
goto chr8:10480278
collapse
snapshot UICEX_0001_chr8:10480278.png
load UICEX_0003_T1.bam
load UICEX_0003_C2.bam
collapse
snapshot UICEX_0003_chr1:16974893.png
私が試したこと
gawk コマンドをネストすることでこれが実現できると思いました。試してみたのがこれです:
SAMPLEFILE = "2016-10-13_mutation_table.txt"
gawk -F";" 'BEGIN{
gawk -F";" -v SAMPLE=$(cat $SAMPLEFILE | cut -d"\t" -f1) -v BAMT=$(cat $SAMPLEFILE | cut -d"\t" -f2) -v BAMN=$(cat $SAMPLEFILE | cut -d"\t" -f3);}{print "new \nload " $BAMN;}
{print "new \nload " $BAMT;}
{awk "{for(i=4; i<=NF-1; i++){ print "goto " $i ; print "collapse\nsnapshot " $SAMPLE"_"$i".png";} }" 2016-10-13_mutation_table.txt;
}END{print "exit \n"}'
しかし、これを実行すると次のようなエラーが発生します。
gawk: cmd. line:2: gawk -F";" -v SAMPLE=$(cat $SAMPLEFILE | cut -d"\t" -f1) ...
gawk: cmd. line:2: ^ syntax error
答え1
try this
$ awk '{printf("load %s\nload %s\n",$2,$3);for(i=4;i<=NF;i++){printf("goto %s\ncollapse\nsnapshot %s_%s.png\n",$i,$1,$i)}}' test.t
load UICEX_0001_T1.bam
load UICEX_0001_C2.bam
goto chr1:16946335
collapse
snapshot UICEX_0001_chr1:16946335.png
goto chr19:9064309
collapse
snapshot UICEX_0001_chr19:9064309.png
goto chr8:10480278
collapse
snapshot UICEX_0001_chr8:10480278.png
load UICEX_0003_T1.bam
load UICEX_0003_C2.bam
goto chr1:16974893
collapse
snapshot UICEX_0003_chr1:16974893.png
答え2
あなたが思われる求めることは次のように行うことができます
awk '
NR > 1 {print ""}
{
printf("load %s\nload %s\n", $2, $3);
for (i=4; i<=NF; i++) {
if (NF > 4) printf("goto %s\n", $i);
printf("collapse\nsnapshot %s_%s.png\n", $1, $i);
}
}
' samplefile