FastQCFastQC Report
Tue 21 Jan 2020
RGA.3.R2.clean.fq.gz

Summary

[OK]Basic Statistics

MeasureValue
FilenameRGA.3.R2.clean.fq.gz
File typeConventional base calls
EncodingSanger / Illumina 1.9
Total Sequences24757151
Sequences flagged as poor quality0
Sequence length20-100
%GC45

[OK]Per base sequence quality

Per base quality graph

[OK]Per sequence quality scores

Per Sequence quality graph

[FAIL]Per base sequence content

Per base sequence content

[OK]Per sequence GC content

Per sequence GC content graph

[OK]Per base N content

N content graph

[WARN]Sequence Length Distribution

Sequence length distribution

[FAIL]Sequence Duplication Levels

Duplication level graph

[WARN]Overrepresented sequences

SequenceCountPercentagePossible Source
AAAGTTTTGAGGTTTACACAAAAGCAAAGGGAAATTAACCGGTGAAGCTT255230.10309344560688748No Hit

[OK]Adapter Content

Adapter graph

[FAIL]Kmer Content

Kmer graph

SequenceCountPValueObs/Exp MaxMax Obs/Exp Position
AAGTCGG79850.029.67194694
GGGGGAT75900.015.007941
CGGGAAC111700.014.8597611
TAGGGCG28950.013.6510848
TTAATAC63050.013.6421693
GTAGGGC33250.012.1653447
TTTAATA103650.011.9318872
GGGCCCT32600.011.6948068
CGTGCAT48550.011.66988594
TTGAGGT282100.011.3721557
ATTTAAT93200.011.1246351
AGGGCGG38750.010.5586359
AGTTTTG300650.010.4539953
GTTTTTT246050.010.4306771
GGCGCCC76150.010.39370866-67
GGGGATA109850.010.1156692
GTTTTAT162750.010.084411
TTTGAGG330450.010.0740496
GAGGTTT305650.010.054819
TAATACA90050.010.0164734