上下文生成」共找到 2804 篇相关文章

算法论文8

视觉感知RAG × 多模态推理 × 强化学习 = VRAG-RL

数字化时代视觉信息愈发重要,传统RAG方法处理视觉信息面临挑战。阿里巴巴通义实验室的VRAG - RL将强化学习引入多模态智能体训练,革新检索生成范式,提升视觉语言模型多方面能力,代码已开源。

PaperAgent
开源动态7

不写、不看、不审查:这家安全公司决定不再让人类碰代码,还把这套模式开源了

2026年2月,安全公司StrongDM公开“软件黑灯工厂”式生产线成果,人类不直接写代码和审查,由Agent自动生成。该模式开源,虽有开发者指出问题,但获学界认可,不过面临成本高的现实问题。

InfoQ
产品应用8

AI Coding后端开发实战:解锁AI辅助编程新范式

文章指出AI Coding应用中开发者存在认知误区,基于实践为后端开发者提供使用指导。涵盖个人上下文管理、输出质量判断等内容,介绍核心使用流程,涉及项目开发、脚本处理等场景及最佳实践。

阿里云开发者
开源动态7

SGLang|SGLang Diffusion

来自SGLang开源社区的Yichi介绍SGLang Diffusion,它是面向图像与视频生成的全开源扩散模型推理引擎。基于SGLang机制将能力迁移到扩散模型推理,能显著提速工作流,视频展示了多种功能。

GiantPandaLLM
推荐文章8

最火VLA,看这一篇综述就够了

ICLR 2026爆火领域VLA全面综述来了!作者Moritz Reuss是2025年Apple AI/ML学者奖得主。文中明确VLA概念,介绍八大趋势,指出评测失真问题,还提及未来需重视数据质量与上下文学习。

量子位
8

豆包 AI 编程:一句话写赛博鱼缸,动嘴皮改富士滤镜

豆包发布全新模型 1.6 后,AI 编程更新,基于此模型在评测集位列第一梯队。它实现低门槛+可用性,能一句话生成网站、工具,还可可视化编辑,目标是让普通人能做产品。

刘言飞语
产品应用8

别再纠结选哪个模型了,这个项目让它们一起干活!豪赠1亿token,羊毛薅起来!

元脑企智 EPAI 推出「多模融合」API,让多个模型围绕同一任务协同工作。经代码生成、财务分析等测试及权威评测,效果出色。还采取智能调度等策略,现限时申请可免费使用,豪赠1亿token。

GitHubStore
开源动态8

港大开源视频版RAG,像聊天一样看完百小时纪录片。

港大HKUDS团队开源超长视频理解框架VideoRAG,突破传统模型时长限制,支持对数百小时视频精准检索和问答。还有桌面应用Vimo,使用简单高效。介绍了其切片索引、混合检索、生成回答的实现逻辑。

开源AI项目落地
开源动态8

腾讯开源了一个通用智能体,又刷榜了GAIA~

腾讯优图实验室开源了 `Youtu-agent`,在深度搜索和工具使用benchmark上表现佳。它不依赖GPT/Claude,有自动智能体生成功能,提供单、多智能体模式,还集成分析平台,可实时调试与离线分析。

探索AGI
开源动态7

AI驱动的研究报告生成器Open Deep Research

Open Deep Research是AI驱动的研究报告生成器,用户提问题可获全面且有来源的答案。它采用Next.js 15等技术栈,经多步骤生成综合报告,还介绍了克隆与运行方法及项目地址。

GitHubStore