「方法创新」共找到 2352 篇相关文章
ICCV 2025 | UniOcc: 自动驾驶占用预测与推理统一数据集及基准平台
来自多所高校团队在ICCV 2025发表统一基准框架UniOcc,融合多源数据,有体素级运动流标注等创新,提出免真值评估指标,支持协同预测,已开源,能推动自动驾驶迈向新阶段。
新手必看!强化学习入门指南 | 从RLHF、PPO、GRPO到RLVR,最后到训练推理模型
Unsloth团队发布强化学习教程,从吃豆人谈起,介绍RLHF、PPO、GRPO等概念,分享用GRPO训练推理模型技巧。涵盖强化学习基础知识,还给出Unsloth使用GRPO训练模型方法及奖励函数示例。
百年钢城 智启新程!两场机器人赛事在首钢园举办
8月1日,第二十八届中国机器人及人工智能大赛人形机器人专项赛全国决赛、2026赛季Robotex世界机器人大会京津冀选拔赛在首钢园举办,展现从工业锈带到创新高地的转型,推动了产学研合作与青少年科创培养。
深度解读|从 LLM Wiki 到 Google OKF,如何重建企业 Agent 的可靠知识底座
文章深入解读 LLM Wiki 与 Google OKF,探讨如何重建企业 Agent 可靠知识底座。指出 RAG 检索有局限,Wiki 式体系可整理知识。介绍 LLM Wiki 构想、OKF 规范及构建符合 OKF 约定的 LLM Wiki 的方法。
郎园 Station Pet&Me|园区宠物友好再升级,以爱筑就人宠共生小天地
首创•郎园Station位于朝阳区东坝,是北京国际化潮流文化地标,2025年园区年度客流量450万人次。产业上,它运营AIGC视听产业创新中心,携手多家企业构建全产业链生态,影视后期制作企业占国内超60%份额。
Agentic-KGR:通过多智能体强化学习实现知识图谱的协同演化
文章指出静态知识库有覆盖缺失、时效滞后、建用分离问题。介绍 Agentic - KGR 创新点,如动态 schema 扩展等。实验显示其在图谱抽取和下游 QA 任务有提升,还呈现训练动态和图谱质量可视化结果。
清华、快手提出AttnRL:让大模型用「注意力」探索
清华和快手团队提出新框架AttnRL,引入注意力机制提升过程监督强化学习效率与性能。它解决传统方法在分支位置选择和采样策略上的效率问题,实验显示在多基准测试中表现优异。
英伟达用NIM + NV-Tesseract模型,提高芯片生产良率
芯片制造良率控制难题待解,传统方法各有局限。英伟达推出NV - Tesseract模型家族和NIM推理微服务,二者结合用于半导体晶圆厂生产,可实时发现问题、预测故障,降低成本,为制造打开新大门。
美团开源Agentic新王,速度拉满,工具调用打爆Kimi?
周末美团开源LongCat - Flash大模型,参数量560B,推理速度达100 token/s,成本低,在Agent工具调用表现超Kimi - K2。它有Zero - Computation Experts和ScMoE创新,不过市场表现未获太多认可。
4月22-25日,CCBN2026将在首钢园举办
第三十二届中国国际广播电视信息网络展览会(CCBN2026)4月22 - 25日在北京首钢国际会展中心举办。展会构建多元体系,汇聚众多企业机构,亮点包括数智引领、超高清创新等,还推出展商专属权益计划。