Unlike previous approaches, SPRINT uses attention to learn from embeddings, resulting in some level of interpretability. It turns out the attention mask is sparse with some preference for binding site residues but more for less conserved residues.
1 likes 1 replies
?