大模型数据」共找到 9982 篇相关文章

新闻资讯8

一图看透全球模型!新智元十周年钜献,2025 ASI前沿趋势报告37页首发

新智元十周年峰会发布《2025新智元ASI前沿趋势报告》与《2025新智元ASI产业图谱》,预测2027达ASI临界,智能体全面爆发。报告展示全球模型格局,中国开源模型表现亮眼,还揭晓了创新奖。

新智元
新闻资讯8

汪军对话 Rich Sutton:模型在一定程度上分散了我们对智能理解的注意力

在RL China 2025开幕式上,汪军与图灵奖得主Richard Sutton对话。Richard认为模型缺乏目标和奖励,分散对智能理解的注意力。他强调RL核心是从经验学习,智能原则含梯度下降等,建议将目标解读为“奖励”。

AI科技评论
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强泛化能力。

量子位
新闻资讯7

扒一扒Meta全新模型Muse Spark里藏着的PDR技术

Meta发布闭源模型Muse Spark及‘沉思模式’,背后藏PDR推理技术。该技术通过‘并行起草+精炼’突破性能瓶颈,对比传统长CoT范式优势明显,在AIME竞赛题目测试中准确率显著提升。

PaperAgent
新闻资讯7

记忆罗盘:模型智能体记忆的表征、操作与演进航向 | 直播预约

记忆对基于语言模型的智能体迈向通用人工智能至关重要。来自多所高校及华为的研究团队分析超30000篇论文,提出记忆表征与操作分类坐标系,绘制记忆罗盘指明演进航向。2025.12.24有相关直播。

深度学习自然语言处理
算法论文8

模型合成检查器:UIUC团队挖出Linux内核90余个长期潜伏漏洞

伊利诺伊学香槟分校张令明老师团队的论文提出KNighter,它让模型生成静态分析检查器,在Linux内核挖出92个长期潜伏漏洞,将LLM归纳能力沉淀为规则,带来可落地等好处。

机器之心
新闻资讯7

“像把象塞进冰箱一样困难”,端侧模型是噱头还是未来?

InfoQ《极客有约》X AICon 直播聚焦端侧模型,探讨其落地挑战与破局思路。专家指出端侧部署有隐私、可用性等优势,但面临内存、精度等难题。华为、支付宝等分享方案,还探讨应用场景、商业模式及未来趋势。

InfoQ
开源动态7

打造图像编辑领域的ImageNet?苹果用Nano Banana开源了一个超数据

苹果研究团队提出Pico - Banana - 400K数据集,基于Nano - Banana在OpenImages实拍照片生成编辑对。其系统化设计保证质量与多样性,还构建自我编辑评估流程,为图像编辑模型训练评测奠定基础。

机器之心
开源动态7

SGLang × RoleBasedGroup(RBG):打通模型推理PD分离架构规模化落地的“最后一公里”

PD分离架构对模型推理部署意义重,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。

InfoQ
算法论文8

所有模型,都学物理学:北物理系一篇研究,震撼了AI圈

等机构团队跨界用物理学最小作用量原理,提出新颖方法估计 LLM 生成方向性,揭示其背后‘物理定律’。发现 LLM 生成有细致平衡现象,还能用物理指标给模型画像,让 AI 研究提升到‘物理科学’高度。

机器之心