「多尺度生成」共找到 5702 篇相关文章
商汤科技与南洋理工大开源空间智能多模态SOTA模型
商汤科技与南洋理工大学构建800万量级三维空间数据集,训练出开源SOTA多模态基础模型SenseNova - SI系列。该系列模型在多个权威测试中表现出色,部分超越GPT - 5,还展现出泛化等能力,且能赋能具身智能。
AI已经开始自己设计算法,并且超越顶尖人类专家,人类还能做什么?
谷歌DeepMind团队与加州大学伯克利分校研究显示,AI能设计出超越人类专家的算法。如在多个领域案例中,AI设计的算法在成本、效率等方面表现出色。ADRS方法将系统研究核心环节自动化,人类研究员角色也将转变。
沉寂一个月,openPangu性能飙升8%!华为1B开源模型来了
华为发布专为昇腾端侧硬件打造的openPangu Embedded - 1B模型,仅10亿参数却性能卓越。它运用多阶段训练和优化,在权威基准表现亮眼,V1.1平均分较上月跃升超8%,还介绍了背后技术。
单卡4090也能高质量视频编辑!西湖AGI Lab无训练框架FlowDirector来了
视频编辑门槛高、现有方法开销大且效果不佳。西湖大学AGI Lab团队提出无需训练的FlowDirector框架,可将基于流的视频生成模型改造成编辑工具,质量高、功能广、开销低,解决了时序、结构和编辑幅度问题。
谷歌前CEO深度专访:AI、智能体会重塑世界
谷歌前CEO Eric Schmidt在Ted专访中,从AI起点AlphaGo说起,阐述其从大模型到自主决策智能体的发展,还提及算力电力需求增长、监管、开源等问题,虽挑战多,但他对AI重塑世界充满信心。
谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!
当地时间6月23日,Linux基金会宣布与多公司成立A2A项目,由谷歌捐赠协议规范等。A2A是谷歌4月推出的开放标准,支持智能体通信协作。有开发者认为它或削弱MCP地位,但谷歌称是其“补充”。实际应用有诸多问题待解。
1 分钟,我在百度 App上免费部署了OpenClaw
OpenClaw热度高,但原生部署折腾且成本高,应用少。百度App提供免费轻量部署入口,耗时不到一分钟;百度智能云0.01元可进阶部署。实测它在信息搜集和代码生成任务表现好,但也有局限。
模力工场 030 AI 应用榜:字节新品硬刚 Sora,“随变”登顶榜首
模力工场第 030 周 AI 应用榜揭晓,32 款应用上架,从社区声量高的应用中精选十款。涵盖创作、学习、智能自动化、心理疗愈等领域,上榜应用凸显 AI 从‘简单生成’向‘深度交互与高效执行’转变趋势。
Scaling Law 仍然成立,企业搜广推怎么做才能少踩“坑”?
InfoQ《极客有约》X AICon 直播邀请京东颜林等探讨生成式推荐落地洞察。指出搜广推场景 scaling law 成立且在上升,还分享大模型对搜广推的改变、架构成长方式,及平衡成本等方面的经验。
梁文锋,Nature全球年度十大科学人物!
权威科学期刊《自然》公布2025年度十大科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。