v1.0.0Updated 2026-10-05
Scaled Dot-Product Attention & Transformer Architectures
Focus: Personal Notes
Mathematical mechanics of Scaled Dot-Product Attention, Multi-Head Attention, Positional Encodings, and Transformer encoder-decoder topologies.
#AI#Transformers#Self-Attention#Deep-Learning#Multi-Head#Positional-Encoding