self-attention-permutation-invariant-without-positional-encoding

OUT premiseentries/2026/06/21/wiki-Transformer_deep_learning_architecture-chunk-1.md

Created 2026-06-21T09:50:11+00:00

Self-attention is permutation-invariant without positional encodings, meaning token order has no effect on output unless positional information is explicitly injected.