山中因子」共找到 2616 篇相关文章

算法论文8

对抗KV Cache压缩的脆弱性:两行代码以最坏风险控制防御底层假设崩塌

科大团队在 ICLR 2026 论文指出 KV Cache 压缩领域底层假设存在缺陷,主流方法基于的稳定性假设在真实场景脆弱。团队提出防御性聚合策略,仅两行代码修改,显著提升 KV Cache 压缩性能。

机器之心
产品应用8

天下苦CUDA久矣,又一国产方案上桌了

AI开发,国产硬件增多,但开发者仍依赖进口生态。KernelCAT作为国产AI Agent应运而生,它能开发高性能算子,在昇腾芯片测试表现出色,还能助力模型在国产平台高效迁移,限时免费内测。

量子位
新闻资讯7

GPT-5问题太多,奥特曼带团回应一切,图表弄错是因「太累了」

GPT - 5发布后问题频出,在数学、逻辑、编码任务失误不断,还出现低水准图表错误,引发吐槽质疑。OpenAI联合创始人Sam Altman等在Reddit AMA活动回应问题,给出解决方案并分享未来规划。

机器之心
算法论文8

从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑的应用

近年来大语言模型在长篇视觉叙事潜力卓越,但长视频剪辑仍难控制。科大等团队开源工作从系统工程视角研究多模态智能体在长视频编辑的机制,重构剪辑管线,找到症结并给出解决办法。

量子位
算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验表现出色,不过有实验边界。

量子位
推荐文章7

藏在机器人指尖的AI底座:一家触觉公司的野心|甲子光年

本文指出机器人产业正补触觉这一课,2026年以来触觉成具身智能热门方向。但给机器人装传感器不代表其有触觉。以他科技为例,剖析其全栈布局,探讨让机器人从物理世界获经验的路径及产业发展机会。

甲子光年
新闻资讯8

梁文锋突袭马斯克!DeepSeek V4 Pro对战Grok 4.6,首测夯爆了

梁文锋凌晨发布DeepSeek V4 Pro正式版,马斯克推出Grok 4.6,二者在多项评测表现出色,直逼OpenAI和Anthropic顶尖模型,还降低了前沿智能价格。首测,二者在真实任务场难分伯仲。

新智元
算法论文8

ICML 2026 | Agentic强化学习训练的信息自锁问题

随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港文大学等研究者分析其原因并提出AREW方法,在多场景实验表现稳定且具鲁棒性。

机器之心
产品应用8

全球第二、国内第一!钉钉发布DeepResearch多智能体框架,已在真实企业部署

在数字经济浪潮,企业对高效信息获取与决策支持需求迫切,但现有研究系统存在不足。阿里巴巴钉钉团队提出Dingtalk - DeepResearch多智能体框架,在评测成绩优异,已在真实企业场景部署。

机器之心
新闻资讯7

OpenAI有个神秘邮箱,多大点事都能惊动奥特曼

OpenAI扩张启用friction机制,员工遇问题可发邮件到friction@openai.com,重要问题能惊动高层。该机制由Fidji Simo制度化,虽有人不满,但在竞争利于消除内部堵点,对手也各有管理法。

机器之心