「深度相机」共找到 768 篇相关文章
Agent+Code,打开AI开发新范式
当下企业级AI叙事逻辑转变,传统AI应用有瓶颈。京东云在JDD 2025大会提出“深度应用”理念,推出“Agent+Code”新范式,其包含JoyAgent 3.0和JoyCode 2.0,还通过开源引领行业创新。
李飞飞发布:全球首个多模态世界模型
李飞飞团队的World Labs发布全球首个多模态世界模型Atlas,是多模态自回归扩散Transformer,能相机控制生成、3D重建等,已向部分伙伴开放早期访问,未来将成底层模型。
独家丨前毫末智行CEO顾维灏创业,成立机器人新公司
AI科技评论独家消息,前毫末智行CEO顾维灏成立「紫星勤行」,布局酒店服务机器人赛道。他是老百度人,曾深度参与百度Apollo项目,毫末智行曾获多轮融资,现他在新赛道寻可能。
告别黑箱解释!首个潜变量自动解释框架 | CIKM'25
深度生成模型内部运作如「黑箱」,潜变量意义难捉摸。埃默里大学团队提出LatentExplainer框架,经数据扰动、智能提示、不确定性评估三步,为潜变量生成易懂解释,提升模型解释质量与可靠性。
递归神经网络的复兴:Mixture-of-Recursions
Google DeepMind研究者设计的语言模型,能判断关键单词并进行深度递归计算,通过轻量级“路由器”节省计算资源,在同等训练成本下表现显著优于传统模型,文中还提及其他解决动态算力分配问题的思路。
从文心开源谈起,论大模型发展新生态
6月30日百度宣布开源ERNIE 4.5即文心4.5系列模型,实现预训练权重+推理代码完全开源。文心团队提出创新架构,增强多模态理解能力。今晚7:30,CSDN邀专家深度解读文心开源及行业趋势。
DeepSeek版Claude Code登顶热榜:8700星,鲸鱼哥火了
DeepSeek版Claude Code登顶GitHub热榜,Star量超8700且还在增长。DeepSeek TUI由Hunter Bown用Rust开发,能与DeepSeek深度集成,有多种模式,打破高价API限制,开发者是半路出家的程序员。
SIGGRAPH Asia 2025|电影级运镜一键克隆!港中文&快手可灵团队发布CamCloneMaster
香港中文大学与快手可灵团队联合提出运镜可控视频生成框架CamCloneMaster,引入‘参考即用’范式,告别对相机参数依赖。其训练、测试代码和数据集均已开源,在各项指标上优于SOTA方法。
西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026
过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。
大小模型协同架构在金融智能投顾中的应用与挑战
本文整理自北银金科高级算法专家尹辰轩分享,介绍大小模型协同架构下的大模型投顾方案,能解决幻觉问题、优化回答深度。还提到 12 月 19 - 20 日 AICon 北京站聚焦多热门方向。