「多粒度编辑」共找到 4270 篇相关文章
港科大(广州)联合腾讯AI平台部开源VibeWorlding,3D世界构建迎来Vibe Coding时刻?
香港科技大学(广州)联合腾讯AI平台部提出VibeWorlding,是可通过多轮对话等自主构建和编辑交互式3D世界的多模态智能体框架。团队开源多项数据,其模型经强化学习后表现超GPT - 5.5等。
OpenAI点赞转发的冠军项目,背后藏着一个国人3D生成团队
近日,iOS产品StoryWorld获OpenAI Codex Hackathon冠军,其核心3D资产生成用了DeemosTech的Hyper3D Rodin。从黑客松到英伟达工程场景,3D生成重稳定性等特性。Hyper3D团队技术强,发布编辑功能,推动3D生成走向可控。
百度秒哒负责人朱广翔:AI开发革命的终局,是让创意本身成为唯一的“代码”
百度秒哒负责人朱广翔指出,传统应用开发模式受“不可能三角”所困,而秒哒旨在破局。他还分享了AI时代生产力公式,强调多智能体协作关键,认为AI开发终极目标是让人聚焦创意,且不会取代产品经理和程序员。
我用“悟空”做了应聘和OPT Skills,预测上班和创业成功率丨龙虾OPT创业笔记
钉钉发布全球首个企业级 Agent 平台“悟空”,它是AI产品进入下一个时代的探索,能接入多平台真实数据,操作公司流程。通过开发者应聘、跨境电商、知识博主等场景案例,展现其能力,还能预测创业成功率,解决企业使用AI的安全痛点。
纯血国产!4B模型越级打怪,杀入万亿赛道
9月1日,Hugging Face上线星火X2.5-4B和1.7B开源端侧模型,在多指标测试中表现优异,实现“越级打怪”。该模型基于全国产算力平台训练,在断网笔记本上实测效果惊艳,使用了两项技术提升能力,适配性强。
多家芯片公司业绩飙涨,这个赛道彻底火了?
近期多家A股芯片公司Q3财报亮眼,受益于端侧AI推进。端侧AI优势多,吸引科技巨头布局,但落地有挑战。技术进步使大模型轻量化,手机与AI眼镜较热。其发展面临应用、技术、生态等问题,也有隐私保护方案。
无需NeRF/高斯点后处理,视频秒变游戏模型成现实!新方法平均每帧仅需60秒 | ICCV 2025
KAUST团队提出全新方法V2M4,能从单目视频直接生成高质量、显式的4D网格动画资源。该方法构建多阶段流程,涵盖相机轨迹恢复等关键步骤,平均每帧约60秒,比现有方法显著提速,论文已被ICCV 2025接收。
小扎「梦之队」首批论文上线!LLM自举进化,单步性能狂飙22%
Meta超级实验室MSL新论文探索用强化学习微调大语言模型。提出探索迭代(ExIt)法,基于RL自动课程学习,训练仅需单步任务,模型学会多步自我改进。在MLE - bench上,ExIt相对GRPO提升约22%。
微软最新揭秘:「话痨实习生」AI助手,到底能帮人类做什么?
基于20万微软Copilot使用数据的研究指出,AI能支持研究、写作和沟通任务,但无法完全胜任单一职业所有任务。Copilot执行任务多为解释型,写作和信息收集任务满意度高,语言和创作类职业受影响大。
Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%
为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源。