融合策略」共找到 1375 篇相关文章

推荐文章8

北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。

Founder Park
产品应用7

实战指南:从零构建 MCP 架构下的 Agentic RAG 系统,无第三方MCP Server

五一期间作者用MCP架构从零实现Agentic RAG系统,分享MCP与Agentic RAG融合思考、架构设计,介绍MCP服务端和客户端实现,还做了端到端效果演示,指出架构优势及待优化处。

AI大模型应用实践
新闻资讯7

外行瞎写的Vibe Coding,都能并入Agent 工程了:最吓人的是,我们“摆烂”有正当理由了

本文编译了软件专家 Simon Willison 在播客的访谈内容。他指出 Vibe Coding 与 Agent 工程正走向融合,AI 写代码渐趋可靠,人类审查成开发瓶颈,还探讨了 AI 对编程的影响、算力成本博弈等问题。

InfoQ
算法论文8

别再用单选评测骗自己了!Amazon新论文揭示了大模型在多选题中的3种系统性偏差

Amazon新论文揭示大模型做多选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型多选题正确率。

深度学习自然语言处理
开源动态8

AI地理学家诞生:麻省理工、斯坦福用多智能体框架重塑地理空间建模,刷新SOTA

麻省理工、慕尼黑工大及斯坦福AI实验室发布GeoEvolve框架,深度融合地理知识与进化算法,实现复杂地理空间模型自动发现与优化。经实验验证,其性能超越以往基准,有望在多领域发挥作用。

AIGC开放社区
开源动态8

Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法

阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。

PaperAgent
推荐文章7

GPU为什么能取代CPU,成为计算领域无可争议的核心?

过去CPU是计算核心,如今GPU凭借并行处理能力崛起。在人工智能、大数据等领域,GPU优势明显,软件支持也推动其普及。未来,GPU将在更多领域发挥作用,还会与CPU融合

芯师爷
产品应用8

华为云再掀算力风暴:CloudMatrix384超节点将升级,Tokens服务性能最大可超H20四倍

华为云在全联接大会2025发布新进展,如CloudMatrix超节点升级、首创EMS服务等。其以“算力黑土地”理念,用智算+通算策略满足产业需求,Tokens服务优势显著,还支撑多领域应用。

量子位
算法论文8

首个全面梳理语音大模型发展脉络的权威综述,入选ACL 2025主会

香港中文大学团队语音语言模型综述论文《Recent Advances in Speech Language Models: A Survey》被 ACL 2025 主会议接收,这是该领域首个全面系统综述,指明语音 AI 未来方向,还剖析技术架构、训练策略等。

机器之心
算法论文8

CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」

新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略

新智元