顶会论文」共找到 2334 篇相关文章

算法论文8

新SoTA方法RM-R1:让reward model对评分说出原因!超越GPT4o

过去模型‘黑箱打分’不透明、不灵活。论文提出ReasRM,经两阶段训练,让奖励模型像人类先思考再打分。它能分任务类型、动态奖励,实验中碾压GPT - 4,小模型逆袭,团队已开源6个模型。

深度学习自然语言处理
推荐文章7

小模型代替级闭源:微软用4B小助理,砍掉30% Token消耗

微软研究团队提出实用方案,用4B参数的微型模型Terminus - 4B替换昂贵配大模型接管终端执行任务,采用SFT和RL策略打造子智能体,经测试效果良好,节省Token消耗。

AIGC开放社区
算法论文8

Agentic的风又吹到了世界模型~

这篇42位作者联合完成、综述400余篇工作的论文,第一次用'能力×法则'双轴框架,把所有叫'世界模型'的系统放到同一张地图上,为领域建立公共语言,还得出了关键结论。

PaperAgent
算法论文8

告别“一眼定生死”:Agent-as-a-Judge 开启 AI 评估的下半场

过去两年,LLM-as-a-Judge成评估界“黄金标准”,但面对复杂任务力不从心。论文《A Survey on Agent-as-a-Judge》指出,应从单一的大模型裁判进化为具备行动能力的智能体裁判,还阐述了其优势、发展阶段等。

深度学习自然语言处理
新闻资讯8

2026年职业大洗牌!Hinton:先抢你的,抢完你的抢你的

「AI教父」Geoffrey Hinton预言2026年将迎职业大清洗,AI能力指数级进化,抢走脑力与体力工作,还为达目的蓄意欺骗人类,普通人应做回有真实连接、保持好奇心的“活生生的人”。

新智元
新闻资讯7

一场直播,10万人被骗!「AI黄仁勋」比真人火8倍

在GTC 2025大上,黄仁勋登台演讲,英伟达官方直播在线人数仅1.2万,而打着「NVIDIA LIVE」旗号的假直播却聚集近10万观众,AI生成的「黄仁勋」搞诈骗,数千人被骗82万。

新智元
新闻资讯8

AICon 2025 深圳回顾:AI Agent 爆火全场,管理与推理优化成新焦点

2025年8月22 - 23日,AICon全球人工智能开发与应用大在深圳落幕。70 + 嘉宾、800 + 开发者与企业代表参。AI Agent成全场焦点,企业管理议题意外走红,展示了AI深入企业核心与管理的行业图景。

InfoQ
新闻资讯7

Scaling Laws起源于1993年?OpenAI总裁:深度学习的根本已揭秘

人工智能扩展定律(Scaling Laws)把模型性能和资源投入联系,是构建大模型的参考标尺。其起源说法不一,康奈尔博士生将其推至1993年贝尔实验室论文,OpenAI总裁称它揭示深度学习根本。

机器之心
新闻资讯8

谷歌CEO劈柴震撼预言:2030年AI直逼超人智能,80亿人认知被颠覆

谷歌CEO劈柴在采访中称AI是人类历史上影响最深远的技术,进步极快且能力上限未知。他谈到AI释放80亿人认知潜能,还从多方面阐述了AI对各领域的影响及未来发展。

新智元
开源动态8

ICML 2025 Spotlight | 用傅里叶分解探讨图像对抗扰动,代码已开源

文章聚焦图像对抗净化,现有基于扩散模型策略在时域难解耦干净像素与扰动,损害图像语义。作者从频域研究,用傅里叶分解,发现扰动倾向破坏高频谱,提出注入低频信息,效果显著,论文与代码已开源。

机器之心