transformer-self-attention-permutation-invariant

IN premiseentries/2026/06/21/wiki-Transformer_deep_learning_architecture-chunk-1.md

Created 2026-06-21T09:55:54+00:00

Self-attention is permutation-invariant (order-agnostic), so transformers require positional encoding (fixed or learned) to preserve sequence order information.