Do Language Models Need a Trainable Input Embedding Table? Fixed Minimal Token Codes at 1.7B-Class Scale Paper • 2610.04002 • Published 6 days ago • 3