Transformer-Architektur
Die strukturelle Basis von GPT-Modellen. Dieser Mechanismus nutzt Self-Attention-Layer, um die Relevanz verschiedener Segmente innerhalb eines Datenstroms gleichzeitig zu bewerten. Im Gegensatz zu rekurrenten Systemen ermöglicht dies eine parallele Verarbeitung von Token-Sequenzen, was den Durchsatz massiv erhöht.