多模态代码生成」共找到 4153 篇相关文章

算法论文8

Self-Forcing++:让自回归视频生成模型突破 4 分钟时长极限

加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让自回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。

机器之心
推荐文章8

把 UI 生成接进流水线:基于半监督评测体系的 UI 自动化生产实践

本文来自蚂蚁集团黄兆嵩在 QCon 2026 的演讲,探讨生成式 UI 技术重塑生产方式。提出系列工程实践,包括高质量生成、LUI 场景应用及质量监控迭代,让前端生产自动运转、用户体验随需而变。

InfoQ
开源动态8

首个基于 MCP 架构的低代码 RAG 框架

检索增强生成系统复杂度提升,科研人员面临高昂工程成本。清华大学等联合推出 UltraRAG 2.0,基于 MCP 架构,降低复杂 RAG 系统技术门槛与学习成本,支持低代码构建复杂系统。

GitHubStore
产品应用7

AI 编程工具在大型企业“遇冷”?网易 CodeWave 升级研发模式,不只关注“代码生成

近些年,自然语言编程成 AI 编程产品主流。C 端通用 AI coding 工具表现出色,但国内企业级市场 AI 技术渗透率低。网易 CodeWave 专注企业级场景,指出通用工具痛点,提出‘可控的 AI coding’定位并升级能力,未来还将推新开发模式。

AI前线
产品应用8

用“蒸汽机”生成视频,还能音视频一体化交付?

8月21日百度营销发布百度蒸汽机2.0,含多版本,有声版可音视频一体化交付。经测试,其生成视频细节佳、运动规律合理。它能解决影视业诸多痛点,成本低,还可免费使用。

AI产品黄叔
开源动态8

13.8K star!!6G显存就能跑的AI视频神器,支持1分钟生成,这么6?!

现在AI视频生成领域仍面临高算力需求挑战,斯坦福大学研究团队推出`FramePack`项目,降低了本地AI视频创作硬件门槛,有低硬件需求、高效生成速度等特色,操作也简单。

开源先锋
产品应用7

这样更公平:用jina-reranker-m0为多模态文档打分重排

文章指出多模态搜索领域给文档综合评分难,因文本与图像评分缺乏可比性。2025年4月发布的jina - reranker - m0可解决此问题,其两阶段检索流程能显著提升召回率,对多模态AI系统设计有启发。

Jina AI
新闻资讯7

再见,人类程序员!OpenAI自曝:一行代码都不写了,100%用Codex

OpenAI研究员Roon称Codex已接管其100%代码编写工作,内部爆料还显示Codex助力三天搭服务器、三周推APP。Codex CLI更新至0.9+,但AI代码审查成难题,开发者和非开发者面临不同挑战。

新智元
开源动态8

NeurIPS 2025 | 蚂蚁CGM:图融合架构重塑代码大模型,探索非 Agent 新范式

在NeurIPS 2025上,蚂蚁将展示Code Graph Model (CGM)。它把代码库图结构集成到开源LLM,开启新范式,在代码库级任务上以非Agent方案登顶开放权重模型榜首,解决了复杂软件工程的Agent依赖难题。

PaperAgent
算法论文8

快9倍还更清晰?Direct3D-S2一键解锁高效3D生成

在高分辨率三维形状生成中,传统方式有计算与内存瓶颈。南京大学提出Direct3D - S2框架,基于稀疏体积构建,有空间稀疏注意力机制,加速计算,还引入统一格式VAE,生成质量领先,训练成本更低。

带你学AI