gpt-2-1-5b-params-webtext
IN premise — entries/2026/06/21/wiki-Generative_pre-trained_transformer-chunk-1.md
Created 2026-06-21T09:50:09+00:00
GPT-2 had 1.5 billion parameters and was trained on WebText (40GB, 8 million web pages). Its release was staged due to misuse concerns.
Summary
This is a factual anchor recording that GPT-2 was a 1.5-billion-parameter model built on roughly 8 million web pages, and its creators judged the output convincing enough to require a gated, staged rollout rather than open distribution. It matters because it marks the point where language models crossed from academic experiments into tools that raised genuine safety and misuse concerns, setting a baseline against which later releases and policies are measured.
Dependents
These beliefs depend on this one:
- IN gpt-series-demonstrated-exponential-capability-emergence — The GPT series demonstrated exponential capability emergence across four generations: basic language modeling (GPT-1, 117M params, 2018) → zero-shot multitask (GPT-2, 1.5B, 2019) → few-shot in-context learning (GPT-3, 175B, 2020) → multimodal reasoning (GPT-4, 2023).