「权重约束」共找到 300 篇相关文章
ICML 2025 | 无需训练,即时对齐大模型偏好
上海人工智能实验室提出TPO方案,可让大模型在推理时快速对齐人类偏好,无需更新模型权重。TPO类似文本形式的梯度下降,在多个基准数据集评测中表现出色,还提供“宽深结合”推理拓展策略。
PITT | 提出PhyT2V框架:让文生视频(T2V)更符合物理规律(CVPR2025)
当前T2V技术迈向推理驱动阶段,物理规律是关键约束。匹兹堡大学团队提出PhyT2V框架,不依赖模型重训练或大规模外部数据,可增强主流T2V模型能力,有低落地门槛和良好泛化性。
完全相信 AI 代码的 Uncle Bob,坦诚这条路还没走通
在AI代码普及当下,Uncle Bob放弃人工评审代码,搭建管控框架引争议,Grady Booch反对,认为AI无法替代资深工程师。Uncle Bob设强约束体系,虽有成效但自动化架构规划未达理想,还给出开发建议。
DeepSeek,Qwen,Grok组团发布,社区一手实测
LLM大爆发,一天内推出Grok 4.6、Qwen3.8 - Max、DeepSeek - V4 - Pro - 0813三款前沿产品。社区对它们进行多场景测试,如3D场景、Flappy游戏、飞机滑行动画等,并对比了不同模型的性能、价格和输出质量。
从“会用”到“驾驭”:AI Coding 进入生产环境的真实碰撞
InfoQ《极客有约》X AICon 直播栏目,邀网易游戏林香鑫等探讨 Coding Agent 重构软件工程环节。嘉宾分享了 AI Coding 在生产环境的变化、MCP 等概念作用、代码质量保障、Agent 权限及 AI 原生研发体系建设等观点。
为什么HBM能摆脱传统周期?
当前市场对HBM和DRAM能否摆脱传统半导体周期性存争议。过去半导体周期由消费电子换机节奏驱动,而AI推理不同,大模型推理对内存依赖是硬约束,GPU更新对HBM需求几乎注定指数级增长。
太意外!教皇和Anthropic创始人,要联袂开发布会
5月26日,教宗利奥十四世将发布通谕《Magnifica Humanitas》聚焦「AI时代对人的保护」,Anthropic联合创始人Chris Olah受邀。梵蒂冈同步成立AI委员会。但有人质疑这是道德外包或公关道具,全球也缺乏有效约束AI发展的机制。
必看!Sebastian Raschka新博客盘点了所有主要注意力机制
著名AI技术作家Sebastian Raschka发布博客《现代LLM中注意力变体的可视化指南》,回顾近年开发并用于开放权重架构的注意力变体,包括多头、分组查询、多头潜在等注意力机制,还分析各机制特点、应用场景及优劣势。
突破万次连续编辑极限!中科院提出首个理论保稳的知识保留方法
中科院信工所研究人员提出LyapLock,将连续编辑建模为受约束随机规划问题,整合排队论和李雅普诺夫优化。实验显示,它能突破万次连续编辑极限,编辑效果比主流方法提升11.89%,还可赋能现有模型。
面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文
面壁智能团队提出SALA,基于此训练的MiniCPM-SALA模型,在单张A6000显卡实现百万token超长上下文推理,训练成本降约75%。它结合稀疏与线性注意力,采用混合架构,继承权重降低成本,在长文本处理上优势明显。