双层生成架构」共找到 3870 篇相关文章

算法论文7

“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%

多模态长文档视觉问答常见于科研论文等场景,现有技术路线有大视觉 - 语言模型直接端到端和检索增强生成,但各有缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。

PaperAgent
开源动态8

国产MiroMind智能体框架,登顶全球预测未来大模型榜单

国产MiroMind公司在全球首个动态实时预测基准FutureX上夺冠,老板是陈天桥。其开源的MiroFlow v0.2智能体框架优势明显,能升级大模型能力,且成本低、可复现。MiroMind在预测赛道领先。

AIGC开放社区
新闻资讯8

谷歌发布AP2协议,联手PayPal放大招:AI要自己下单了

2025年9月17日,谷歌推出智能体支付协议AP2并开源,宣布与PayPal战略合作。AP2通过‘授权令牌’解决AI下单信任问题,设计三种场景令牌,还采用角色架构保证安全,谷歌联合超60方搭建生态。

AIGC开放社区
开源动态7

腾讯开源框架 Kuikly 再升级!率先适配 “液态玻璃”,原生体验更极致

腾讯开源框架Kuikly再升级,在苹果发布iOS 26系统背景下,新增“液态玻璃”适配。文章分析了“液态玻璃”给跨端框架带来的挑战,对比不同架构路线适配情况,还介绍了Kuikly的适配经验。

腾讯技术工程
开源动态8

2.3K Star 霸榜GitHub!DeepResearch最佳开源平替!

DeepResearch能递归拆解复杂任务自动生成报告,但OpenAI的相关产品费用高且闭源。霸榜GitHub的ROMA由Sentient AGI团队开发,性能超Grok - 4等,是开源杀手,还介绍了功能、使用方法和应用场景。

开源星探
产品应用7

再也不怕面瘫脸!YouTube黑科技:AI帮你「永久微笑」,连僵尸都咧嘴笑

YouTube在Shorts相机里实现AI实时「重绘」人脸,效果自然。它通过知识蒸馏将大模型「瘦身」成小模型,用迭代蒸馏打磨细节,PTI保证身份特征,MediaPipe搭建推理管道,还将拓展视频生成功能。

新智元
算法论文8

具身VLA后训练:TeleAI提出潜空间引导的VLA跨本体泛化方法

现有VLA基座模型能力不足,跨本体适配存在挑战。中国电信人工智能研究院具身智能团队提出“对齐 - 引导 - 泛化”(ATE)框架,实现从调架构到调分布的范式转移,适配主流VLA模型,减少数据需求。

机器之心
产品应用8

如何破解海量内容审核难题?快手安全大模型技术探索与应用实践

在数字内容爆炸式增长下,传统内容审核模式难应对挑战。快手安全算法中心负责人刘梦怡分享自研多模态大模型技术方案与应用实践,涵盖架构、数据、训练等,还介绍审核智能化应用及未来展望。

InfoQ
产品应用8

95% 企业 AI 投资无回报?华为云 × 合力亿捷:客服 Agent 给出解题思路

麻省理工报告显示 95% 企业生成式 AI 投资无回报,但指出办公自动化等领域回报率高。客服 AI Agent 是热门方向,华为云与合力亿捷合作的方案解决行业痛点,打通数据闭环,有示范意义。

InfoQ
推荐文章7

RAG效果不佳?先别急着微调模型,这几个关键节点才是优化重点

文章深入探讨RAG技术实现与优化,指出其在AI应用开发中常被当黑盒,从文档分块、索引增强、编码、混合检索到重排序等关键环节解析,强调结合场景调优以提升召回与精确率。

阿里云开发者