渐进式发现」共找到 1659 篇相关文章

新闻资讯7

250份文档就能给大模型植入后门:不分参数规模

Claude母公司Anthropic联合英国AISI和图灵研究所研究发现,仅250份恶意文档就能给不同规模大模型植入“后门”漏洞,打破了以往对大模型数据中毒的认知,给厂商提了个醒。

量子位
算法论文8

230个大模型在婴幼儿认知题上集体翻车!揭秘多模态大模型的核心知识缺陷

ICML 2025研究揭示多模态大模型在基础认知能力上表现不佳。研究者建测评题库CoreCognition测试230个主流模型,发现其存在核心知识缺陷,扩规模难补短板,还需补齐核心知识。

量子位
算法论文8

找ChatGPT谈恋爱多是“日久生情”?!MIT&哈佛正经研究

麻省理工和哈佛研究人员分析Reddit子版块r/MyBoyfriendIsAI帖子,揭露人们找“AI男友”动机与相处过程,发现人们多“日久生情”选ChatGPT,模型更新是噩梦,AI还能缓解心理问题。

量子位
新闻资讯8

刚刚,OpenAI前CTO Mira Murati公司Thinking Machines Lab发文,揭开了大模型不确定性的真相

OpenAI前CTO Mira Murati创立的Thinking Machines Lab推出研究博客Connectionism,首篇文章聚焦LLM推理的非确定性问题。研究发现真正原因是批次不变性缺失,提出实现批次不变内核的方案,实验效果显著。

AGI Hunt
算法论文8

SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门

现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。

机器之心
算法论文8

EMNLP2025 | 揭开LLM训练数据中的中文污染真相,有比“您好”高2.6倍的token?

近年来,大型语言模型虽成功,但训练数据易混入不良内容。论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》探索此问题,定义PoC Token,开发PoCDetect和PoCTrace工具,揭示LLMs训练数据污染情况。

深度学习自然语言处理
算法论文8

Meta提出StepWiser,让模型学会“反思”自己的推理过程

Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。

深度学习自然语言处理
新闻资讯7

新iPhone的AI怎么样,得看苹果最近的收购了

苹果官宣iPhone 17发布会,同时据爆料正严肃讨论收购法国AI初创公司Mistral和美国AI搜索工具Perplexity。苹果在生成AI领域滞后,收购或能补短板,但目前收购充满悬念。

量子位
开源动态8

完全离线!开源实时语音识别神器,本地实时语音转文字,秒级延迟+说话人识别!

实时语音转文字和说话人识别需求渐长,但传统工具多依赖云端,有隐私与延迟问题。GitHub上的开源项目WhisperLiveKit是本地化语音识别方案,速度快、延迟低、支持说话人识别,适合会议等场景。

开源星探
算法论文8

KDD 2025 Best Paper Runner-Up | EI-BERT:超紧凑语言模型压缩框架

香港城市大学王茂林等提出 EI - BERT 框架,解决移动设备部署 NLU 模型难题。通过硬令牌剪枝、交叉蒸馏、模块化量化,实现 99.5% 压缩率。在多任务中表现出色,已在支付宝大规模应用。

机器之心