Engram
The breakthrough memory architecture integrated into DeepSeek-V4.1-Flash. Engram stores massive factual world knowledge and long-range repository symbols in a 196B parameter hashed associative memory table, retrieved in constant O(1) time without triggering heavy transformer attention layers.
https://github.com/deepseek-ai/Engram
- Decouples factual knowledge storage from transformer attention layers, keeping active parameter count ultra-lean.
- Constant O(1) retrieval latency regardless of knowledge base size.
- The V4.1-Flash model card lists Engram conditional memory at 196B parameters. An AIME 96.7 score was removed; it is not in that card's tables.