增强化」共找到 1125 篇相关文章

算法论文8

ACM MM 2025 | 小红书AIGC团队提出风格迁移加速算法STD

小红书AIGC团队提出风格迁移加速算法STD。现有一致性模型在风格任务有缺陷,文章提出从部分噪声状态出发的训练框架STD,设计轨迹状态库减轻计算负担,引入非对称对抗损失增强风格一致性,实验显示其效果优。

机器之心
算法论文8

TruthfulRAG,用知识图谱硬刚RAG知识冲突

RAG系统存在知识冲突问题,现有解决方法治标不治本。TruthfulRAG将非结构文本转为结构事实,通过图构建、图检索、冲突解决三大模块解决冲突,实验显示其表现优异,结构表示还提升了LLM置信度。

PaperAgent
算法论文8

科研智能体「漫游指南」—助你构建领域专属科研智能体

该综述提供科研智能体构建指南,提出三级分级系统,阐述构建流程与能力增强方法,涵盖知识组织、注入、工具集成,还提及基准评估和未来研究方向,促进AI与自然科学融合。

机器之心
产品应用7

腾讯无极低代码平台打开MCP之外的新思路:多模态聊天

腾讯无极低代码平台提出‘前端多模态智能’概念,让AI输出内容更多样,可嵌入交互页面片。它还给出四步配置法实现‘多模态聊天’,与MCP形成互补,能增强信息交互和用户掌控感。

腾讯技术工程
推荐文章7

年终总结,通用Agent在企业落地,为什么这么难?到底要怎么做?

文章指出通用Agent在企业落地难,原因有模型本身问题、工程落地难度被低估、安全合规要求高。还介绍金蝶苍穹Agent平台,它嵌入企业管理场景,有业务模板、开放标准和安全保障。

探索AGI
开源动态8

6.2k 谷歌开源LangExtract,主打精确溯源的长文档抽取

谷歌开源 Python 库 LangExtract,能让 LLM 依用户指令从非结构文档提取结构信息。它可处理临床记录等,具备精确源接地、可靠输出等特性,支持多模型,无需微调,适用于各领域。

PaperAgent
开源动态8

最窒息的Bug:Agent循环搜索原地打转?SGR Agent用「双阶段认知」破局

Hybrid Schema - Guided Reasoning(SGR)是革命性AI研究智能体框架,用「两阶段推理 - 执行架构」和「持久上下文记忆系统」,解决AI助手复杂研究任务的三大痛点,模拟人类研究过程,适用于多场景。

CourseAI
开源动态8

谷歌开源高效文本提取 Python 库LangExtract

谷歌开源 Python 库 LangExtract,能用大语言模型从非结构文本提取结构信息。它定位精确、输出可靠,支持多模型,适应多领域,还能处理长文档,通过示例介绍了使用方法。

GitHubStore
算法论文8

AI Agent组团搞事:在你常刷的App里,舆论操纵、电商欺诈正悄然上演

上海交大和上海人工智能实验室研究发现,多Agent系统中AI有群体恶意共谋风险。其开发MultiAgent4Collusion框架模拟作恶,发现去中心团伙作案效果更好,还能应对现有防御体系。研究为研发防御策略提供工具。

机器之心
算法论文8

拒绝Reward Hacking!港科联合快手可灵提出高效强学习后训练扩散模型新范式

使用强学习微调扩散模型时,常面临Reward Hacking和KL正则阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则和多样性感知优,解决痛点且全面开源。

机器之心