Developer Shares 2.6B Engram Model Training Update
A developer detailed the architecture of a 2.6B Engram model: frozen embeddings/LM head derived from OLMo 3, a 4.3B Engram table, layered SWA, and AttnRes for context-aware retrieval. The model is still in training and represents an early open experiment.