「生成式方法」共找到 2688 篇相关文章
超越RAG,DRAG让LLM准确率飙升45.5%,问题越复杂能力越强
RAG技术虽能让LLM检索资料生成答案,但存在短板,听不懂话里有话。DRAG方法应运而生,有DRA和RSC两大法宝,经对比实验,它在多任务上领先,准确率大幅提升,计算开销小。
清华辍学、斯坦福睡地板,华人小哥用AI社交挑战Meta,融资数千万美元
来自中国的小哥Brandon Chen打造AI原生即时通讯工具Intent,已获数千万美元融资。它结合微信聊天与大模型自动执行功能,如处理图片、规划旅行、生成购物清单等,带来全新聊天体验。
一文带你彻底理解AIGC、Agent、MCP的概念和关系
本文为非AI开发者科普AIGC、Agent、MCP概念和关系。AIGC用AI生成内容;Agent可自主决策调用工具;MCP是Anthropic开源协议,降低模型与工具集成成本,获大厂支持。
ViT一作盛赞:这个中国开源“PS模型”强过Nano Banana
ViT核心作者Lucas Beyer连发三条帖子怒赞通义千问发布的开源模型Qwen—Image—Layered,认为这是图像生成的正确打开方式。该模型可实现PS级拆图自由,支持精细化修改图片元素,核心技术是端到端的扩散模型。
开源 AI 视频平台
开源 AI 视频平台集成剪辑生成器、AI 短视频、YouTube 工作室三大工具,能将长视频转短视频,为业务生成营销视频,还具备免费 YouTube 工具包。支持多平台发布,自托管永久免费。
AI产业的新胜负手:词元的生产与编排|甲子光年智库
AI产业正走向“代理式执行”,核心生产逻辑从“数据驱动”转为“词元驱动”。文章阐述了词元经济的形成、生产过程及运行链路,指出AI竞争将围绕词元生产与编排展开。
这张信息图,居然是8B开源模型做的??
商汤新开源的 8B 多模态模型 SenseNova U1,架构独特,图像评测表现好,信息图生成能力强、延迟低。它具备图文交错能力,适合自媒体、敏感行业等,有在线体验和开源代码入口。
动态RAG新工作:效果爆了,代码已开源
大语言模型幻觉问题突出,现有动态RAG方法信号不可靠。QuCo-RAG从预训练语料库挖掘统计证据,用客观频率替代主观置信度,实现毫秒级幻觉检测与动态检索触发,代码已开源。
干掉延迟!12G显存就能实现实时AI换脸直播,开源免费。
推荐开源项目PersonaLive,它是基于自回归流式扩散技术的实时人像动画生成框架。能平衡画质与低延迟,用一张照片在普通显卡实现数字分身实时驱动,有低显存、无限时长等特点。
AEPO:智能体熵平衡策略优化,让探索更稳,推理更深!
中国人民大学与快手团队联合提出 AEPO 算法,解决熵驱动式智能体强化学习训练不稳等问题。它设计两项核心机制,在 14 个基准上优于主流算法,在 X 等平台获高关注。