NeurIPS 2025
NLP · Transformer
Efficient Transformer for Long-Context Retrieval
提出稀疏注意力机制,在 128k token 上下文下实现 4x 推理加速,检索准确率无损。
机器学习、NLP 与推荐系统方向。
提出稀疏注意力机制,在 128k token 上下文下实现 4x 推理加速,检索准确率无损。
跨域推荐系统的 GNN 架构,冷启动场景 CTR 提升 18%。
少样本多语言适配方法,在 20 种低资源语言上超越 baseline 12%。
自监督预训练提升搜索排序模型,线上 A/B 测试 NDCG@10 提升 7.2%。