Sorted by year.

2026#

  1. Nanbeige4.2-3B: Unlocking Agentic Capabilities in a Compact Model

    Core Contributor

    Technical Report, 2026

  2. Memory Decoder at Scale: A Pretrained, Parametric Long-Term Memory

    Rubin Wei, Jiaqi Cao, Jiarui Wang, Junming Zhang, Qipeng Guo, Bowen Zhou, Zhouhan Lin

    Preprint, 2026

  3. MLP Memory: A Retriever-Pretrained Memory for Large Language Models

    Rubin Wei*, Jiaqi Cao*, Jiarui Wang, Jushi Kai, Qipeng Guo, Bowen Zhou, Zhouhan Lin

    International Conference on Learning Representations, 2026

    * Equal contribution

2025#

  1. Memory Decoder: A Pretrained, Plug-and-Play Memory for Large Language Models

    Jiaqi Cao*, Jiarui Wang*, Rubin Wei, Qipeng Guo, Kai Chen, Bowen Zhou, Zhouhan Lin

    Advances in Neural Information Processing Systems, 2025

    * Equal contribution

Citation counts last refreshed: .