「自蒸馏策略优化」共找到 2064 篇相关文章
SIGGRAPH Asia 2025:摩尔线程赢图形顶会3DGS挑战赛大奖,自研LiteGS全面开源
12月17日,在SIGGRAPH Asia 2025上,摩尔线程凭自研LiteGS获3DGS重建挑战赛银奖。3DGS是下一代图形渲染技术,有巨大潜力但训练耗时久。摩尔线程开源LiteGS,实现全链路协同优化。
如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验
文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。
“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%
文章聚焦多模态长文档视觉问答,介绍现有LVLM - based和RAG - based技术路线及困境。提出MMRAG - DocQA方案,引入‘分层索引 + 多粒度检索’,设计双索引建模相关性与依赖,用互补策略实现证据互补。
GPT-5 Pro独立做数学研究!读论文后给出更精确边界,OpenAI总裁:这是生命迹象
OpenAI研究人员喂给GPT - 5 Pro一篇凸优化问题论文,它读完给出更精确边界及证明。虽成果被人类论文反超,但思路不同,显示其有独立探索能力,OpenAI总裁称这是“生命迹象”。
字节真的要干生态了?Coze竟然开源了
字节开源 Coze Studio 和 Coze Loop,此时 Dify 等已在 Agent 基础设施赛道站稳。Coze Studio 提供 AI Agent 开发环境,Coze Loop 负责优化平台,技术栈扎实。开源版功能有删减,字节野心是抢占生态范式。
ParScale:一种全新的大模型Scaling Law
文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。
人工智能无法加速软件交付
文章指出速度不是软件交付目标,提升效率是为获反馈。片面追求速度不可取,如微软 Word 因功能堆砌失市场。引入人工智能只为提速不可信,应重视反馈,优化交付流程,借助 AI 打造更有格局产品。
智谱发布龙虾基座模型GLM-5-Turbo,还适配了一个养龙虾的盒子
智谱发布专为龙虾场景深度优化的基座模型GLM - 5 - Turbo,从底层训练重塑,增强四项核心能力。发布评测基准ZClawBench,模型表现领先。还推出龙虾套餐和安全管理体系,助力企业实现算力自由与安全管控。
AI下半场的战场,从Agent记忆体正式打响
OpenClaw开源项目爆火,标志AI进入下半场走向真实应用。关键在于解决AI在现实中持续干活的问题,核心是Agent Memory。论文梳理该赛道,指出其是系统级记忆体结构框架,未来关键在memory策略可学习。
用Rust重写OpenClaw,Transformer作者下场造了安全版「龙虾」
Transformer八子之一Illia Polosukhin用Rust构建安全版OpenClaw——IronClaw。他指出OpenClaw有数据和资金安全风险,IronClaw以安全为核心,有多项安全设计,未来还会增加策略验证等能力。