「三维环境生成」共找到 2697 篇相关文章
76%程序员依赖AI?代码安全挑战解析
GitHub报告显示76%程序员用AI编程,代码安全成挑战。腾讯等团队建A.S.E评测框架,有项目级代码生成等优势,能评估代码安全、质量与稳定性,未来将扩充功能,邀开发者参与。
研究者尝试揭示扩散模型创造力的起源
斯坦福大学研究人员 Mason Kamb 与 Surya Ganguli 在论文中提出解释扩散模型创造力的机制,指出其创造力是去噪生成图像时的确定性结果,还识别出关键偏置,搭建 ELS 机模型并验证其准确性。
太牛了~~复杂表格Cell合并、跨页拼接,中文领域96%,甩MonkeyOCR 20%
在PDF文档解析领域,复杂表格解析是难题。今天分享的OCRFlux是基于qwen2.5vl - 3B模型微调的解决方案,有单页解析和跨页段落/表格合并等创新点,测试得分超96%,远超MonkeyOCR等。
无需训练,即插即用,2倍GPU端到端推理加速——视频扩散模型加速方法DraftAttention
高质量视频生成任务中,扩散模型成主流,但DiT模型注意力机制计算量大,成推理瓶颈。现有加速法效果不佳,为此美国东北大学等团队提出DraftAttention,可2倍加速推理且不损画质。
2025 AI Cloud 100 China榜单发布:6个赛道,34家新上榜,DeepSeek、Manus上榜
6月22日,靖亚资本等发布2025 AI Cloud 100 China榜单,聚焦GenAI商业落地企业。还发布行业趋势报告,总结融资、技术等情况,预测未来五大趋势,如AI应用从Copilot升级到Autopilot等。
百文心快码正式发布AI IDE,首创设计稿一键转代码、支持MCP
6月23日,百度副总裁陈洋发布文心快码独立AI原生开发环境工具Comate AI IDE,是行业首个多模态、多智能体协同的AI IDE,首创设计稿一键转代码,亮点多、功能强,适配开发场景。
揭秘千卡 GPU 集群如何高效训练多模态大模型:vivo AI 团队实战经验分享|AICon
在 InfoQ 举办的 AICon 大会上,vivo AI 架构师王兆雄分享多模态大模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。
何恺明评审,谢赛宁获奖!牛津华人博士生拿下CVPR 2025最佳论文
CVPR 2025奖项揭晓,投稿量增13%,接收率22.1%。最佳论文来自牛津与Meta AI,提出新前馈网络。还公布年轻研究者等多奖项,何恺明任最佳论文评审。
何恺明改进了谢赛宁的REPA:极大简化但性能依旧强悍
扩散生成模型在建模复杂数据分布表现出色,但与表征学习领域关联不大。谢赛宁团队提出REPA,不过较麻烦。何恺明团队提出Dispersive Loss,简化且性能强,无需预训练等,适用于多种模型。
The Batch:831 | 机器翻译正在实践中发挥作用
人工智能为语言学习应用巨头 Duolingo 带来生产力提升,借助生成式 AI 构建 148 门课程,总量翻倍。其 AI 辅助课程构建法能快速转化多语种版本,还在评估多模型,不过此举也引发批评。