Hello Ian, old question, but I just ran into the same problem mentioned above without being able to find a suitable answer.
Processing my dual indexed reads, the UMI is appended to the first part of the header before a space.
@M08672:8:000000000-KRLFC:1:1101:10036:1113_TCT 1:N:0:ACCTAAGC+TGGATTCG GGTCGATCGCGCCTCGAGGGCGGCCAGTATTATGCCAGGGAAGATGAAGGACACGGGGGCGTTTGGATTAGCCTGCAGTGTGGGGATTATGTAGTGCTCCGATATGAACGAAAATAGCTGGCCCCACCAAGATCGGAAGAGCACA
However, this naming scheme (read:is filtered:control number:index barcodes) is retained in the BAM file:
M08672:8:000000000-KRLFC:1:2114:25930:12617_AGA 1:N:0:GTCCTACT+CAGGATGA 99 NC_009333.1
If I look into the 'deduplicated_per_umi.tsv' file, the UMI are labeled as:
AAA 1:N:0:ACCTAAGC+TAGATTCG, AAA 1:N:0:ACCTAAGC+TGGATTCG, AAC 1:N:0:AACTAAGC+TGGATTCG, etc.
Am I just misinterpreting the output or is there something else I should be doing?