多智能体大语言模型」共找到 9615 篇相关文章

产品应用8

开发者狂喜:Thinking Machines发布首款产品Tinker,后训练麻烦全给包了

OpenAI前CTO创办的Thinking Machines推出首款产品Tinker,这是用于微调语言模型的API,能简化LLM后训练过程,支持前沿模型,使用LoRA技术降低成本,还发布开源库,多高校团队已试用。

机器之心
算法论文8

模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队等最新研究打破传统认知,揭示‘对齐税’现象。提出置信解码策略,在多架构、评测集上表现出色,能绕过‘对齐税’,提升推理准确率,且工程开销低,为大模型发展提供新思路。

量子位
新闻资讯8

20美元,扒掉AI安全底裤!智能体2小时,攻破160亿美元巨头

红队安全创业公司CodeWall的AI智能体,花20美元Token费、运行2小时,自主选麦肯锡为目标,攻破其「数字大脑」Lilli,获4650万条聊天记录等读写权限,暴露AI安全隐患。

新智元
开源动态7

我用这个开源的「智能体记忆操作系统」,30分钟做了一个AI备忘录应用。

文章推荐开源记忆项目MemOS,它是为智能体打造的记忆操作系统,能让AI有长期记忆体系。作者用其30分钟做出AI备忘录应用,还介绍了MemOS框架,称它是AI转变的关键基建。

开源AI项目落地
开源动态8

社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!

阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。

Hugging Face
算法论文8

省下1.25倍算力!Kimi这篇论文,可能改写所有大模型的训练方式

模型层数增多时,残差连接存在PreNorm稀释问题,导致后面层贡献被稀释。Kimi论文提出Attention Residuals方案,还给出工程解法Block AttnRes,实验显示能省算力且提升效果。

AI寒武纪
算法论文8

从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

深度神经网络虽应用广泛,但对对抗样本脆弱,制约可靠部署。本文介绍发表于TPAMI 2026的工作,提出基于一致性模型的对抗净化方法(CMAP),实验表明其在不同场景下鲁棒性强,为对抗防御提供新视角。

量子位
算法论文7

估值840亿AI实验室再放大招,他们要给大模型戴上「紧箍咒」

新智元报道,OpenAI前CTO创办的Thinking Machines Lab发布研究「模块流形」,将传统数值修正转为「预防式」约束优化。它提出新范式,为训练大模型提供新思路,还介绍了流形优化器及相关算法。

新智元
算法论文8

博士答辩PPT分享 | 高雷诺数湍流场数据同化与湍流模型机器学习研究

西北工业大学孙旭翔博士的论文聚焦航空航天湍流模拟难题,结合数据驱动与同化方法,构建全流程框架,提出数据同化与模型修正方法,设计集成框架,实现高雷诺数复杂流动精确高效模拟。

力学与人工智能
新闻资讯8

OpenAI o1核心大佬离职后首次演讲!AI智能体=人力+代码「无限杠杆」

OpenAI研究员Hyung Won Chung离职后发声,认为AI是人类历史上最强大杠杆,结合人力与科技优势。它能提升个人学习效率,智能体作为复合杠杆让小团队创造大价值,还能加速社会科学进步。

新智元