优化原理」共找到 1420 篇相关文章

算法论文8

打破确定性魔咒!北航团队提出VBF++:用“不确定性建模”刷新多模态视频推荐 SOTA

北京航空航天大学和北京邮电大学联合提出VBF++框架,将多模态融合从“点估计”升级为“分布建模”。它由上下文感知先验、推荐引导的对抗优化和元学习三大组件构成,在多个数据集上刷新SOTA。

AI前线
开源动态7

从大模型到多模态,图文混排Agent彻底起飞~

上周智谱多模态开源周,从GLM 4.6v到Autoglm,其图文并排使用场景很吸睛。上传PDF论文,它能生成图文混排解读文章,效果好。作者逆向原理复刻代码,还分享GLM 4.6V三个有意思的能力。

探索AGI
7

AI修真的一年:学者们怎么看“真智能”?|甲子光年

甲子光年在年终盛典对话三位学者,探讨AI“真假智能”。学者们提及强化学习、推理、多模态等技术突破,分析研究路径,还谈选择标准与未来期待,指出AI是工程实践命题,真与假关乎信念选择。

甲子光年
新闻资讯7

DeepSeek-V3.2巨「吃」Token,竟然是被GRPO背刺了

DeepSeek-V3.2发布后引起关注,但长思考版本暴露出Token使用效率不佳问题,消耗远超同类模型。这或与GRPO算法缺陷有关,其目标函数存在长度和难度偏置,长度偏置仍是该版本高Token消耗的原因。

机器之心
推荐文章8

Karpathy:LLM渴望的不是生存,而是你的点赞

Andrej Karpathy指出人们对‘智能’理解肤浅,动物智能与LLM智能源于不同优化压力。动物智能源于自然选择,而LLM智能来自统计模拟、强化学习微调等,两者在多层面有差异,LLM受商业进化影响大。

AI寒武纪
算法论文8

这些大神在Meta的论文看一篇少一篇了

田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。

量子位
开源动态7

AI时代,我们为何重写规则引擎?—— QLExpress4 重构之路

AI时代下规则引擎需求旺盛,QLExpress4全面重构。它性能提升,编译和执行性能显著提高;体验优化,支持JSON语法、有表达式追踪功能;还在淘天、钉钉等有应用场景,且对AI友好。

阿里云开发者
产品应用7

用 AI 开发网站?这个 MCP 必装,Next.js 原生 MCP 已上线!

Next.js官方发布了自己的MCP,具备自动化调试等诸多功能,能增强代理在该框架下的开发能力。它可集成Playwright MCP,查询文档和最佳实践等,还说明了使用流程、提问方式及原理

AI进修生
产品应用8

刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」

Cursor 2.0发布重大更新,带来自研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。

机器之心
推荐文章7

实战·Agentic 上下文工程(上):无需微调,让智能体自我学习与进化

在Agent时代,提示工程进化成上下文工程。斯坦福等团队提出Agentic Context Engineering(ACE),让智能体自我学习与进化。文章介绍了上下文工程的必要性、定义、常见策略,以及ACE的概念、原理与架构。

AI大模型应用实践