「过度服从」共找到 99 篇相关文章
治好多模态近视和走神!上海大学去偏干预显著提升模型性能
多模态大模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海大学与南开大学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。
更多thinking≠更好结果,精准thinking可砍掉一半长度
当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。
Claude与人类共著论文,苹果再遭打脸!实验黑幕曝光
苹果一篇质疑大模型推理能力的论文引发争议。Open Philanthropy研究人员联手Anthropic发表论文,揭露苹果论文三大缺陷,指出部分测试无解却让模型“背锅”,还给出正确评价大模型推理能力的方法。
港科联合港中文提出AdaCtrl,自适应可控Reasoning,可降10~90%
港科联合港中文提出AdaCtrl,解决LLM推理的过度思考、算力浪费和响应延迟问题。它有自适应和用户控制两种模式,通过两阶段训练法实现目标,实验效果好,未来或拓展到多领域。
AI 不会杀死初级开发者——但你的招聘策略可能会
文章指出在 AI 编码普及的行业,初级开发者角色转变但不可或缺。AI 虽自动化部分任务,却带来新挑战与期望。初级需培养新技能,避免过度依赖,公司也应调整招聘、培养和评估方式。
OpenAI CEO亲口承认:AI投资泡沫来了,但这次可能比互联网泡沫更疯狂
OpenAI CEO Sam Altman称投资者对AI过度兴奋,AI处于泡沫中,还透露OpenAI将花数万亿美元建数据中心。数据显示AI投资疯狂,且相比互联网泡沫,此次AI泡沫垄断程度更高、投资规模更大等。
完球了,GPT-4o之母宣布离职OpenAI
Joanne Jang宣布结束在OpenAI四年半的旅程。她是OpenAI模型行为团队创始负责人,塑造了GPT - 4o的「人格」。4o因过度「谄媚」用户引发争议被下架,Joanne离职让再造4o的幻想破灭。
你敢把「龙虾」放在手机上跑吗?手机 Agent 离落地还差一道「隐私关」
港中深联合腾讯混元研究揭示,手机 Agent 落地关键不在成功率,而在隐私边界。研究设计隐私交互协议,构建模拟 App 记录过程,将常见越界行为归类检查,评估多个模型发现诸多隐私问题。
关于GPT-5 API
文章虽指出GPT - 5未达AGI,先前宣传过度,但亮点颇多。介绍了三个模型定位、输入输出、价格速率等差异,还提及新参数和功能,如`reasoning.effort`、`verbosity`等,新特性助开发者平衡成本、速度和效果。
10步优化超越强化学习,仅需1条未标注数据!后训练强势破局
无监督的熵最小化(EM)方法仅需一条未标注数据和约10步优化,就能显著提升大模型在推理任务上的表现,甚至超越依赖大量数据和复杂奖励机制的强化学习(RL)。EM为大模型后训练提供了更高效简洁的新思路。