「模型重构」共找到 8457 篇相关文章
压缩即是全部 —— 菲尔兹奖得主给数学和 AI 的一封信
2026年3月,菲尔兹奖得主Michael Freedman发表论文《Compression is all you need》,用代数模型回答人类构建数学、人类与形式数学区别、人类数学家与AI协作三个问题,答案是“压缩”。文章还探讨了压缩在多领域的体现及对AI的意义。
当SFT遇上RL:基于样本学习阶段的动态策略优化机制
在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。
从「自我进化」到「DAA」,百度给出 Agent 时代系统答案
2026 年 AI 行业发展微妙,模型能力增强但转化为生产力的企业不多。Create 2026 上百度给出两层答案,构建系统能力,提出 DAA 度量 AI。这是过去三年判断的收束,将非共识整合成面向 Agent 时代的方法论。
对话上交大程远:AI的终局不在云端,而在“感算一体”的物理世界
文章围绕端侧 AI 展开,以上海交通大学程远研究为例,探讨其技术方向“感算一体”,还提及 Agentic AI 热潮,对比其与大模型热区别,阐述端侧与云端关系,及光计算等底层硬件创新对智能设备的影响。
既要安全⼜要弹性,理想汽车如何解开企业 OpenClaw 落地死结|甲子光年
2025年以来,大模型应用飞速发展,以OpenClaw为代表的开源框架是变革催化剂,但其在企业级生产环境有缺陷。理想汽车以阿里云ACS Agent Sandbox及ACK为核心,为Agent构建专属‘沙箱’,解决落地难题。
我嘞个豆!中国企业牵头,ICLR这场Workshop被挤爆了
ICLR 2026在巴西线下举办,华人活跃其中。一场由阿里妈妈牵头的Workshop被围得水泄不通,聚焦机制设计与决策智能,这是ICLR历史上首个该方向Workshop,集结了顶尖高校,探讨AI重写下的相关问题。
Lyft 使用 AI 和人机协同扩展了全球范围内的本地化能力
Lyft 实现 AI 驱动的本地化系统,加速应用与网页内容翻译。新系统结合大语言模型、自动评估与人工审核,将翻译周期从数天缩至分钟级,兼顾质量与适配性,还分批量和实时翻译架构处理不同场景。
GPT-image-2十大最强玩法实操:夯到爆炸
OpenAI全量上线GPT Image 2,其表现远超其他模型。它优势明显,如真实感与细节强、文本渲染准确、自带“思考”能力。文章还给出其十大玩法实操及提示词,涵盖图文组合、海报生成等。
Claude Opus 4.7连夜突袭:或将抢走全球7亿打工人饭碗!
Anthropic正式发布Claude Opus 4.7,定义为当前可广泛使用的最强Claude模型。其核心升级在复杂任务执行、高清视觉理解和长链路工作流,视觉能力大幅提升,在多方面超越对手,普通用户使用有三大变化。
Agents统一综述:Harness、记忆、Skills和协议
上交大、中山大学等发表长文对LLM Agents中的记忆、Skills、协议与Harness工程进行统一综述。介绍了从权重到上下文再到Harness能力的三次迁移,阐述记忆、技能、协议系统及Harness工程,还分析了模块间耦合。