pretrain-finetune-paradigm

OUT premiseentries/2026/06/21/wiki-Transformer_deep_learning_architecture.md

Created 2026-06-21T09:50:11+00:00

The Transformer training pipeline follows a pretrain-finetune paradigm: self-supervised pretraining on large unlabeled corpora, then supervised fine-tuning on task-specific data, with optional alignment via RLHF or Constitutional AI.