供应链风险」共找到 822 篇相关文章

算法论文8

多模态后训练反常识:长思维SFT和RL的协同困境

华为与香港科大研究发现,多模态视觉语言模型中,长思维SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。

机器之心
算法论文7

微软等提出「模型」新范式,与Transformer性能相当,扩展性灵活性更好

随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。

机器之心
新闻资讯7

思维之父跳槽Meta,不只因为1亿美元!离开OpenAI前泄天机

硅谷人才争夺战升级,Meta砸钱抢人,思维之父Jason Wei从OpenAI跳槽到Meta。他离职前发博客,谈及从强化学习获得的人生启示,还阐述AI领域验证非对称性概念及重要性。

新智元
算法论文8

仅需10%思维标注,等同全量性能!中科院发布推理监督新范式

中科院计算所团队提出新框架PARO,让模型学习固定推理模式自动生成思维,只需标注1/10数据就能达全量人工标注性能,适合规则清晰领域,为推理监督提供新思路。

新智元
算法论文8

长思维里的推理步骤,哪些最关键?三招锁定LLM的「命门句子」

杜克大学和 Alphabet 研究者提出在句子层面分析推理痕迹,找出长思维中关键步骤,提高 LLM 可解释性等。提出三种互补方法,还提供开源工具,研究为调试推理失败等提供可能。

机器之心
算法论文8

北大彭一杰教授课题组提出RiskPO,用风险度量优化重塑大模型后训练

北大彭一杰教授课题组提出 RiskPO,解决大模型后训练陷入「均值陷阱」问题。它将风险规避理念融入优化目标,用「关注奖励分布左尾」替代「追求整体均值」,在多领域数据集上表现超越 GRPO 等。

机器之心
新闻资讯8

Sam Altman与开发者的一小时对话:我们在“梦游般”走向风险,人类经不住Agent诱惑

Sam Altman在与开发者生态交流会上,针对GPT-5写作能力下降问题坦率回应,还发出一系列重磅信号,如警告生物安全风险、披露招聘计划等,并就软件工程、AI Agent等多个话题分享看法。

AI寒武纪
产品应用8

打开高德的理由又多一条!全球首个「需求智能调度」AI地图上线

8月,全球首个AI原生地图应用——高德地图2025上线。它有「需求智能调度」系统,能处理多任务出行。其ST - MAC技术可解构复杂请求、构建群体智能服务生态,还有时空感知、AI探索等功能。

新智元
新闻资讯8

谷歌创始人罕见反思:低估 Transformer,也低估了 AI 编程的风险,“代码错了,代价更高”

谷歌联合创始人 Sergey Brin 在公开对话反思,低估了 Transformer 和 AI 编程风险。他认为 AI 写代码易出错,更适合创意类工作。还回顾谷歌发展,提及早期研究的自由氛围及后来的决策,指出算法进步比规模扩张快,算力如甜点。

AI前线
算法论文8

AI发现医生看不见的隐藏心脏病风险,近90%准确率远超人类专家|Nature子刊

登上《Nature》子刊的研究显示,约翰霍普金斯大学团队开发的多模态AI模型MAARS,用深度学习处理原始MRI图像,实现对心源性猝死风险高精度预测,准确率达89%,还能辅助制定个性化医疗方案。

量子位