找到 1 篇关于此标签的文章
Reddit 上一位独立研究者发布 Wave Field LLM,声称用新的注意力机制把训练复杂度降到 O(N log N),并在 128K 上下文下避免传统方案爆内存。我们判断,这更像一次值得跟踪的底层架构试验,而不是马上可用的产品突破。