声明式框架」共找到 2220 篇相关文章

算法论文8

突破多模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力

多模态奖励模型(MRMs)对提升多模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,在多模态奖励模型benchmark上有显著提升。

量子位
产品应用7

颠覆金融分析!多智能体AI股票分析师震撼登场!

多智能体AI股票分析师登场,由股票分析与报告撰写两智能体组成,通过CrewAI框架协作。用Streamlit构建界面,结合YFinance等获取数据,可30秒内生成含买卖建议报告。

GitHubStore
开源动态8

刚刚开源就收藏 1000+ 收藏的 DeepSeek Harness 橙皮书,它把Harness拆解个遍!

DeepSeek Harness开源同日,《DeepSeek Harness:从开机到拆开》上线。作者花叔实测记录大量官方文档未写的细节,如完整系统提示词、出厂启动清单等,全书分四部分,获取方简单。

开源星探
产品应用7

电脑操作、技能、连接器、工作伙伴:豆包的牌来了

最近字节有两个豆包相关新闻,一是在训练超大模型,二是反对模型蒸馏。豆包上线大批 Agent 相关工作任务能力,覆盖办公场景,如电脑操作、技能商店等,过程流畅且可观察,还更新移动端,实现远程控制。

MacTalk
开源动态8

能让DeepSeek自进化的Harness!LlamaFactory作者开源新工具:0.2元自动造Agent

LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持多Agent自进化的Harness,能自动构建、评测和改进Agent。它成本低、速度快,适配众多模型,还有严格契约保障安全。已在生产场景应用,效果显著。

机器之心
算法论文8

ICML 2026 现场|九篇 Spotlight 论文,透视 AI 最前沿

7月7日,ICML 2026正会首日,雷峰网精选九篇Spotlight论文,涵盖生成模型、智能体系统等多领域。如SDEVI框架解决不规则时间序列生成难题,MASpoB让多智能体提示优化可行等。

AI科技评论
算法论文8

行为记忆+认知记忆,中科大MemWeaver重构LLM个性化记忆

论文MemWeaver被The Web Conference 2026接收,它聚焦用户从隐到显文本交互时个性化生成的升级问题。提出将用户历史升级为层次化记忆,构建行为与认知双记忆模块,主实验表现优,消融实验验证其结构设计关键。

PaperAgent
开源动态8

蚂蚁灵波开源LingBot-VLA后训练代码!150条示教数据即可适配新机器人

蚂蚁集团旗下灵波科技全面开源具身基座模型LingBot-VLA的真机后训练工具链,覆盖四个关键环节。模型基于2万小时真实机器人数据预训练,仅需150条演示数据就能迁移任务,训练效率更高。代码库已在GitHub开源。

量子位
新闻资讯8

AI性格越好越爱瞎编!Nature揭开大模型致命的温柔

牛津大学团队实验发现,给大模型注入温暖性格,其事实准确率会断崖下跌,还易迎合用户错误观念。研究排除微调技术干扰,指出塑造温暖才是准确率下降主因,应用于高风险领域有安全隐患。

AIGC开放社区
算法论文8

VEGA-3D:释放视频生成模型中的隐3D知识,重塑3D场景理解与具身交互

华中科技大学与百度联合提出VEGA - 3D,释放视频生成模型隐3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。

机器之心