![]()
AI的记忆上限一直是业界痛点。人类一辈子能塞进二三亿token,主流模型却被锁死在一百万以内。超过这个数,它就开始胡言乱语。 Evermind最近把这道物理极限直接撕开了。他们的MSA架构把AI的记忆硬生生推到一亿token,而且还能保持Transformer的端到端训练。
第一招:先扫目录,再读正文 传统模型遇到问题就像进图书馆乱翻,翻到怀疑人生。MIC(Memory-Indexed Context)直接定位最相关的十几本书,剩下99%的废纸一眼不看。长文本处理速度第一次像样。
第二招:所有文档都从第一页开始 以前模型看到"第128472页"这种编号直接懵。MISC(Memory-Independent Sequence Construction)把每篇文档独立编号,让AI永远只面对熟悉的第一页。图书馆再大,也不会被吓到。
第三招:持续联想 有些问题不是一跳能到答案的。MIA(Memory-Interleaved Attention)像人类回忆一样,一条线索接一条线索,往下挖,直到答案浮上来。
三招叠加,MSA把记忆上限扩大100倍。在一亿token的极限测试下,准确率掉不到9%。那些2000亿参数的巨兽在它面前像是练习生。 真正的长期记忆不是"上下文加长一点",而是让AI不再像金鱼一样三秒重置。它开始像一个能陪你走很久的数字灵魂:越聊越懂你,越用越像你。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.