「优化原理」共找到 1420 篇相关文章
打破确定性魔咒!北航团队提出VBF++:用“不确定性建模”刷新多模态视频推荐 SOTA
北京航空航天大学和北京邮电大学联合提出VBF++框架,将多模态融合从“点估计”升级为“分布建模”。它由上下文感知先验、推荐引导的对抗优化和元学习三大组件构成,在多个数据集上刷新SOTA。
从大模型到多模态,图文混排Agent彻底起飞~
上周智谱多模态开源周,从GLM 4.6v到Autoglm,其图文并排使用场景很吸睛。上传PDF论文,它能生成图文混排解读文章,效果好。作者逆向原理复刻代码,还分享GLM 4.6V三个有意思的能力。
AI修真的一年:学者们怎么看“真智能”?|甲子光年
甲子光年在年终盛典对话三位学者,探讨AI“真假智能”。学者们提及强化学习、推理、多模态等技术突破,分析研究路径,还谈选择标准与未来期待,指出AI是工程实践命题,真与假关乎信念选择。
DeepSeek-V3.2巨「吃」Token,竟然是被GRPO背刺了
DeepSeek-V3.2发布后引起关注,但长思考版本暴露出Token使用效率不佳问题,消耗远超同类模型。这或与GRPO算法缺陷有关,其目标函数存在长度和难度偏置,长度偏置仍是该版本高Token消耗的原因。
Karpathy:LLM渴望的不是生存,而是你的点赞
Andrej Karpathy指出人们对‘智能’理解肤浅,动物智能与LLM智能源于不同优化压力。动物智能源于自然选择,而LLM智能来自统计模拟、强化学习微调等,两者在多层面有差异,LLM受商业进化影响大。
这些大神在Meta的论文看一篇少一篇了
田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。
AI时代,我们为何重写规则引擎?—— QLExpress4 重构之路
AI时代下规则引擎需求旺盛,QLExpress4全面重构。它性能提升,编译和执行性能显著提高;体验优化,支持JSON语法、有表达式追踪功能;还在淘天、钉钉等有应用场景,且对AI友好。
用 AI 开发网站?这个 MCP 必装,Next.js 原生 MCP 已上线!
Next.js官方发布了自己的MCP,具备自动化调试等诸多功能,能增强代理在该框架下的开发能力。它可集成Playwright MCP,查询文档和最佳实践等,还说明了使用流程、提问方式及原理。
刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」
Cursor 2.0发布重大更新,带来自研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。
实战·Agentic 上下文工程(上):无需微调,让智能体自我学习与进化
在Agent时代,提示工程进化成上下文工程。斯坦福等团队提出Agentic Context Engineering(ACE),让智能体自我学习与进化。文章介绍了上下文工程的必要性、定义、常见策略,以及ACE的概念、原理与架构。