CoV2D Browser

1UUM_1	1XDV_1	1AMF_1	Letter	Amino acid
10	41	7	N	Asparagine
38	33	16	G	Glycine
13	23	3	H	Histidine
3	20	2	M	Methionine
22	32	14	T	Threonine
8	30	7	Y	Tyrosine
21	34	16	D	Aspartic acid
0	14	0	C	Cysteine
18	37	8	Q	Glutamine
0	7	3	W	Tryptophan
32	43	23	V	Valine
28	51	6	R	Arginine
14	63	10	I	Isoleucine
47	84	17	L	Leucine
19	52	15	S	Serine
33	41	34	A	Alanine
20	92	12	E	Glutamic acid
17	63	21	K	Lycine
10	43	9	F	Phenylalanine
19	44	10	P	Proline

Protein code \(c\)	LZ-complexity \(\mathrm{LZ}(w)\)	Length \(n=\|w\|\)	\(\frac{\mathrm{LZ}(w)}{n /\log_{20} n}\)	\(p_w(1)\)	\(p_w(2)\)	\(p_w(3)\)	Sequence \(w=f(c)\)
1UUM , Knot	155	372	0.82	36	198	348	HHHHHHATGDDHFYAEYLMPGLQRLLDPESAHRLAVRVTSLGLLPRATFQDSDMLEVKVLGHKFRNPVGIAAGFDKNGEAVDGLYKLGFGFVEVGSVTPQPQEGNPRPRVFRLPEDQAVINRYGFNSHGLSVVEHRLRARQQKQAQLTADGLPLGINLGKNKTSEDAAADYAEGVRTLGPLADYLVVNVSSPNTAGLRSLQGKTELRHLLSKVLQERDALKGTRKPAVLVKIAPDLTAQDKEDIASVARELGIDGLIVTNTTVSRPVGLQGALRSETGGLSGKPLRDLSTQTIREMYALTQGRIPIIGVGGVSSGQDALEKIQAGASLVQLYTALIFLGPPVVVRVKRELEALLKERGFTTVTDAIGADHRR
1XDV , Knot	322	847	0.85	40	316	770	EQTYYDLVKAFMAEIRQYIRELNLIIKVFREPFVSNSKLFSANDVENIFSRIVDIHELSVKLLGHIEDTVEMTDEGSPHPLVGSCFEDLAEELAFDPYESYARDILRPGFHDRFLSQLSKPGAALYLQSIGEGFKEAVQYVLPRLLLAPVYHCLHYFELLKQLEEKSEDQEDKECLKQAITALLNVQSGMEKICSKSLAKRRLSESACRFYSQQMKGKQLAIKKMNEIQKNIDGWEGKDIGQCCNEFIMEGTLTRVGAKHERHIFLFDGLMICCKSNHGQPRLPGASNAEYRLKEKFFMRKVQINDKDDTNEYKHAFEIILKDENSVIFSAKSAEEKNNWMAALISLQYRSTLERMLDVTMLQEEKEEQMRLPSADVYRFAEPDSEENIIFEENMQPKAGIPIIKAGTVIKLIERLTYHMYADPNFVRTFLTTYRSFCKPQELLSLIIERFEIPEPEPTEADRIAIENGDQPLSAELKRFRKEYIQPVQLRVLNVCRHWVEHHFYDFERDAYLLQRMEEFIGTVRGKAMKKWVESITKIIQRKKIARDNGPGHNITFQSSPPTVEWHISRPGHIETFDLLTLHPIEIARQLTLLESDLYRAVQPSELVGSVWTKEDKEINSPNLLKMIRHTTNLTLWFEKCIVETENLEERVAVVSRIIEILQVFQELNNFNGVLEVVSAMNSSPVYRLDHTFEQIPSRQKKILEEAHELSEDHYKKYLAKLRSINPPCVPFFGIYLTNILKTEEGNPEVLKRHGKELINFSKRRKVAEITGEIQQYQNQPYCLRVESDIKRFFENLNPMGNSMEKEFTDYLFNKSLEIEPRNPKPLPRFPKKYSYPLKSPGVRPSN
1AMF , Knot	104	233	0.81	38	150	227	DEGKITVFAAASLTNAMQDIATQFKKEKGVDVVSSFASSSTLARQIEAGAPADLFISADQKWMDYAVDKKAIDTATRQTLLGNSLVVVAPKASVQKDFTIDSKTNWTSLLNGGRLAVGDPEHVPAGIYAKEALQKLGAWDTLSPKLAPAEDVRGALALVERNEAPLGIVYGSDAVASKGVKVVATFPEDSHKKVEYPVAVVEGHNNATVKAFYDYLKGPQAAEIFKRYGFTIK

Protein code \(c\)

LZ-complexity \(\mathrm{LZ}(w)\)

Length \(n=|w|\)

\(\frac{\mathrm{LZ}(w)}{n /\log_{20} n}\)

\(p_w(1)\)

\(p_w(2)\)

\(p_w(3)\)

Sequence \(w=f(c)\)

1UUM , Knot

155

372

0.82

198

348

HHHHHHATGDDHFYAEYLMPGLQRLLDPESAHRLAVRVTSLGLLPRATFQDSDMLEVKVLGHKFRNPVGIAAGFDKNGEAVDGLYKLGFGFVEVGSVTPQPQEGNPRPRVFRLPEDQAVINRYGFNSHGLSVVEHRLRARQQKQAQLTADGLPLGINLGKNKTSEDAAADYAEGVRTLGPLADYLVVNVSSPNTAGLRSLQGKTELRHLLSKVLQERDALKGTRKPAVLVKIAPDLTAQDKEDIASVARELGIDGLIVTNTTVSRPVGLQGALRSETGGLSGKPLRDLSTQTIREMYALTQGRIPIIGVGGVSSGQDALEKIQAGASLVQLYTALIFLGPPVVVRVKRELEALLKERGFTTVTDAIGADHRR

1XDV , Knot

322

847

0.85

316

770

EQTYYDLVKAFMAEIRQYIRELNLIIKVFREPFVSNSKLFSANDVENIFSRIVDIHELSVKLLGHIEDTVEMTDEGSPHPLVGSCFEDLAEELAFDPYESYARDILRPGFHDRFLSQLSKPGAALYLQSIGEGFKEAVQYVLPRLLLAPVYHCLHYFELLKQLEEKSEDQEDKECLKQAITALLNVQSGMEKICSKSLAKRRLSESACRFYSQQMKGKQLAIKKMNEIQKNIDGWEGKDIGQCCNEFIMEGTLTRVGAKHERHIFLFDGLMICCKSNHGQPRLPGASNAEYRLKEKFFMRKVQINDKDDTNEYKHAFEIILKDENSVIFSAKSAEEKNNWMAALISLQYRSTLERMLDVTMLQEEKEEQMRLPSADVYRFAEPDSEENIIFEENMQPKAGIPIIKAGTVIKLIERLTYHMYADPNFVRTFLTTYRSFCKPQELLSLIIERFEIPEPEPTEADRIAIENGDQPLSAELKRFRKEYIQPVQLRVLNVCRHWVEHHFYDFERDAYLLQRMEEFIGTVRGKAMKKWVESITKIIQRKKIARDNGPGHNITFQSSPPTVEWHISRPGHIETFDLLTLHPIEIARQLTLLESDLYRAVQPSELVGSVWTKEDKEINSPNLLKMIRHTTNLTLWFEKCIVETENLEERVAVVSRIIEILQVFQELNNFNGVLEVVSAMNSSPVYRLDHTFEQIPSRQKKILEEAHELSEDHYKKYLAKLRSINPPCVPFFGIYLTNILKTEEGNPEVLKRHGKELINFSKRRKVAEITGEIQQYQNQPYCLRVESDIKRFFENLNPMGNSMEKEFTDYLFNKSLEIEPRNPKPLPRFPKKYSYPLKSPGVRPSN

1AMF , Knot

104

233

0.81

150

227

DEGKITVFAAASLTNAMQDIATQFKKEKGVDVVSSFASSSTLARQIEAGAPADLFISADQKWMDYAVDKKAIDTATRQTLLGNSLVVVAPKASVQKDFTIDSKTNWTSLLNGGRLAVGDPEHVPAGIYAKEALQKLGAWDTLSPKLAPAEDVRGALALVERNEAPLGIVYGSDAVASKGVKVVATFPEDSHKKVEYPVAVVEGHNNATVKAFYDYLKGPQAAEIFKRYGFTIK

Let \(P_w(n)\) be the set of distinct subwords (intervals) in a word \(w\). Let \(p_w(n)\) be the cardinality of \(P_w(n)\). Let \(f(c)\) be the sequence in FASTA with 4-symbol Protein Data Bank code \(c\).

Newick tree

Pair	\(Z_2\)	Length of longest common subsequence
1UUM_1,1XDV_1	164	4
1UUM_1,1AMF_1	134	4
1XDV_1,1AMF_1	200	4

Status	Protein1	Protein2	d	d₁/2
Query variables	1UUM_1	1XDV_1	284	200.5

In notation analogous to [Theorem 16, Kjos-Hanssen, Niraula and Yoon (2022)],
\[ \delta= \alpha \mathrm{min} + (1-\alpha) \mathrm{max}= \begin{cases} d &\alpha=0,\\ d_1/2 &\alpha=1/2 \end{cases} \]

CoV2D BrowserTM

Newick tree

CoV2D Browser^TM