顶会研究」共找到 3145 篇相关文章

算法论文8

10个小模型并联跑赢GPT-4.1!无额外训练,方法仅4步

上海人工智能实验室等机构提出Avengers框架,无需额外训练,通过四步集结小模型优势。实验表明,其在15个数据集上平均得分超GPT - 4.1,还探究了框架有效的要素,对AI研究和开源社区意义重大。

量子位
算法论文7

函数向量对齐技术,让大模型持续学习不“失忆”丨ICLR 2025

中国科学技术大学等校团队破解大语言模型灾难性遗忘之谜,发现遗忘源于模型激活带偏差新功能,非覆盖旧功能。还设计FVG训练法,保留并对齐函数向量,保护模型能力。相关论文被ICLR2025接收,代码开源。

量子位
开源动态8

ICML 2025 Spotlight | 用傅里叶分解探讨图像对抗扰动,代码已开源

文章聚焦图像对抗净化,现有基于扩散模型策略在时域难解耦干净像素与扰动,损害图像语义。作者从频域研究,用傅里叶分解,发现扰动倾向破坏高频谱,提出注入低频信息,效果显著,论文与代码已开源。

机器之心
算法论文8

Learning from peers!让LRM互相「传纸条」的新协作方式大幅提高准确率和效率

当前主流大模型如QwQ - 32B存在“前缀主导陷阱”,推理开头出错使准确率暴跌。研究者受“同伴互助”启发提出LeaP框架,设计三种路由策略,实验显示小模型能借此超越大模型,开创了多种可能性。

深度学习自然语言处理
产品应用7

Cursor就是最强知识库应用,没有之一

作者认为最好用的知识库应用是Cursor,它有RAG能力,能处理代码和纯文本,可创建修改文档,具备搜索能力且及时支持先进模型。作者还分享用Cursor配合文档工作的规则及使用示例。

newtype AI
算法论文8

TreeHop:无需LLM的高效多跳问答新范式

多跳问答(MHQA)任务有挑战,现有方法依赖LLM,计算成本高、延迟显著。TreeHop研究提出新方案,摒弃LLM,通过嵌入空间动态更新,降低延迟、减少模型参数量,还在主流数据集表现佳,适合工业应用。

深度学习自然语言处理
算法论文8

Auto-Research「终极大考」:新基准撕下大模型科研伪装

来自多所高校的研究者提出MLS - Bench,用于解决现有Auto - Research评测的归因问题。它含140个真实研究任务,校准受控修改范围,主实验显示当前模型在方法发现上有明显缺口,Auto - Research需更严格评测标准。

机器之心
开源动态8

开源 3 天斩获 2.5K Star!这个去AI味写作 SKILL,比市面上的AI检测器更懂写作!

开源项目no-ai-slop上线3天获2.5K Star,它是去AI味写作辅助工具。不只是检测,还能改稿,识别、去除AI套路且保留风格。提供改稿与检测模式,有20+种套路示例,还配自检表。

开源星探
新闻资讯7

他想让TPU成为AI界的X86!

2026世界人工智能大期间,中昊芯英主办分论坛,新一代全自研TPU架构AI芯片“须臾®”亮相,华东地区首个国产TPU智算千卡集群落成。“须臾®”算力强、成本低,集群全链路国产化,中昊芯英探索TPU突围路径。

芯师爷
开源动态8

大部分token根本不该重复计算,不止于KVCache

斯坦福研究显示,AI Agent每次调用62%内容重复,现有前缀缓存虽有优化但天花板低,阿里云数据表明多数缓存块利用率低。LMCache将缓存管理独立,解决性能问题,其CacheBlend技术复用缓存,适配多引擎和存储后端。

AI工程化