FastQCFastQC Report
Tue 21 Jan 2020
PRO.2.R2.clean.fq.gz

Summary

[OK]Basic Statistics

MeasureValue
FilenamePRO.2.R2.clean.fq.gz
File typeConventional base calls
EncodingSanger / Illumina 1.9
Total Sequences24641499
Sequences flagged as poor quality0
Sequence length20-100
%GC45

[OK]Per base sequence quality

Per base quality graph

[OK]Per sequence quality scores

Per Sequence quality graph

[FAIL]Per base sequence content

Per base sequence content

[OK]Per sequence GC content

Per sequence GC content graph

[OK]Per base N content

N content graph

[WARN]Sequence Length Distribution

Sequence length distribution

[FAIL]Sequence Duplication Levels

Duplication level graph

[WARN]Overrepresented sequences

SequenceCountPercentagePossible Source
AAAGTTTTGAGGTTTACACAAAAGCAAAGGGAAATTAACCGGTGAAGCTT255140.10354077891121802No Hit

[OK]Adapter Content

Adapter graph

[FAIL]Kmer Content

Kmer graph

SequenceCountPValueObs/Exp MaxMax Obs/Exp Position
AAGTCGG99700.022.63625594
CGCGTAT21200.019.0622161
CGGGAAC115150.015.1674971
GGGGGAT75250.014.5061231
GCGTGCG30100.013.7345212
TTAATAC56850.012.0926443
CGTGCAT44450.011.52741594
TTAAACG87900.011.5201372
GTTTTAT153100.011.407821
TTGAGGT278850.011.3939817
CTTAAAC159050.011.3315171
AGTTTTG268050.010.9692753
TAAACGT86900.010.9578193
CGCGTGC43350.010.929521
TAGGGCG32550.010.5601658
GCGGCCC37300.010.4606936
TGAGGTT293300.010.4367048
TTTAATA96750.010.3223252
TTTGAGG345300.010.2774846
GGCGTAC36050.010.0503079