String Tokens Int IDs Vectors Next Token Input String Tokenizer Vocabulary Map Embedding Layer Transformer Blocks "Hello World" ["Hello", "ĠWorld"] [8774, 2159] [[0.12, -0.5...], ...] Contextualized Tensors