大模型对齐」共找到 9183 篇相关文章

推荐文章8

人工智能研究者如何意外发现:我们对“学习”的理解,可能全是错的

传统理论认为模型会过拟合,而如今模型却驱动了诸多应用。2019年研究者突破传统扩模型规模,出现‘双下降’现象。‘彩票假说’解释其成功原因,还重新定义了‘智能’,揭示科学进步规律。

宝玉AI
开源动态8

性能涨!阿里开源新版Qwen3模型,霸榜文本表征

今日凌晨阿里开源Qwen3-Embedding和Qwen3-Reranker两款新模型,专为文本表征等任务设计,支持119种语言。测试显示其性能出色,在多语言文本表征和排序任务中超越众多模型,还采用了多种创新设计与训练方法。

AIGC开放社区
算法论文8

让LLM扔块石头,它居然造了个投石机

港中研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。

量子位
算法论文8

Learning from peers!让LRM互相「传纸条」的新协作方式幅提高准确率和效率

当前主流模型如QwQ - 32B存在“前缀主导陷阱”,推理开头出错会使准确率暴跌。研究者受“同伴互助”启发提出LeaP框架,设计三种路由策略,实验显示小模型能借此超越模型,开创了多种可能性。

深度学习自然语言处理
开源动态7

这个框架让模型省下50%内存,合并专家不如直接删掉?

Cerebras Research提出REAP框架,通过专家剪枝和合并技术压缩SMoE模型,能让模型‘瘦身’并保持性能,可省50%内存,但社区测试有不同结果,且存在调度开销等问题。

AI工程化
算法论文8

多模态模型,真的「懂」世界吗?——揭秘 MLLM 的核心知识缺陷

ICML 2025高分论文揭示MLLM核心认知盲区。研究发现主流MLLM缺乏核心认知能力,且不能靠规模扩展自然习得。作者构建测评体系CoreCognition,提出干预测试方法Concept Hacking,还给出关键发现与启示。

机器之心
算法论文8

Meta打开AI元认知,让AI不止会解题,还会总结套路了

Meta等机构提出‘元认知重用’机制,让模型学会反思总结。模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为模型推理难题提供了解决方案。

AIGC开放社区
新闻资讯8

梁文锋,Nature全球年度十科学人物!

权威科学期刊《自然》公布2025年度十科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。

量子位
8

倒计时3周离职!LeCun最后警告:硅谷已陷入集体幻觉

LeCun三周后将从Meta离职,在最新访谈中警告,硅谷对模型的追捧是集体幻觉,模型无法通往AGI。他认为世界模型才是正途,还分享了创业公司AMI的规划,批评了硅谷单一文化,对AGI时间线给出看法。

新智元
新闻资讯7

OpenAI新模型,被曝秘密训练中!万字硬核长文直指o4核心秘密

SemiAnalysis爆料,OpenAI正训练规模介于GPT - 4.1和GPT - 4.5间的新模型,下一代推理模型o4基于GPT - 4.1训练。强化学习成推理模型进步功臣,但面临基础设施瓶颈,奖励函数难定等问题。

新智元