深度学习研究」共找到 3509 篇相关文章

开源动态8

社区供稿丨Ring-2.5-1T,思更深,行更远

今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。

Hugging Face
算法论文8

像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境

为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。

机器之心
新闻资讯7

近十年后谷歌与波士顿动力再「牵手」,这次要为人形机器人注入「灵魂」

近日,在 CES 2026 上,波士顿动力与谷歌 DeepMind 宣布达成全新 AI 合作,将 Gemini Robotics AI 模型与 Atlas 人形机器人深度整合,赋能其完成工业任务,首个应用领域是汽车行业。双方曾有过交集,此次合作被网友看好。

机器之心
算法论文8

北大卢宗青团队新作:超 70% 实机成功率,支持语言指令的功能性抓取系统

现有抓取研究多在稳定性层面,而功能性抓取更接近真实世界的智能。北大卢宗青团队提出DemoFunGrasp方法,对功能性抓取重新建模,在仿真与真实场景均超70%成功率,还引入视觉语言模型让机器人理解语言指令。

AI科技评论
8

量子芯片离商用还有多远?解读半导体的下一代革命

本文深度拆解量子芯片全产业链,指出其成突破半导体产业天花板核心方向。全球多技术路线并行研发,虽有进展但距商用有差距。其商用面临三重壁垒,将分阶段落地,普及后会重塑产业与社会,与传统芯片互补。

芯师爷
算法论文8

AAAI 2026|新突破:北大彭宇新团队提出可见光-红外终身行人重识别方法CKDA

终身行人重识别有重要应用价值,但现有方法在学习特定模态新知识时,会阻碍跨模态公共旧知识保留。北大彭宇新团队提出CKDA方法,解耦并净化不同模态信息,实现跨模态知识权衡,在相关基准上取得最优性能。

机器之心
新闻资讯7

北京艺术与科技周|三联人文城市跨界沙龙:当AI开始写诗、作曲,我们会如何改变?

在算法推荐和AI生成内容充斥的当下,美学标准和感知方式被颠覆重塑。北京艺术与科技周的三联人文城市跨界沙龙,邀胡德夫、叶蓓等嘉宾以诗为起点深度对谈,探讨AI时代美学与人文生活新可能。

798艺术区
新闻资讯8

Meta再推WorldGen,简单一句话,竟「盖」出50×50米一座城

Meta推出WorldGen,可根据文本提示生成可探索的3D世界。它融合多项技术,能生成50×50米完整纹理化场景,保持风格与几何一致。虽处于研究阶段,但成果可兼容主流游戏引擎,有降本增效潜力。

机器之心
算法论文8

用155万模拟视频给模型上课!GVE模型一次学会9种视频检索技能

当前视频检索研究陷入困境,现有模型难以应对复杂检索需求。香港科技大学(广州)联合阿里巴巴通义实验室推出通用视频嵌入模型GVE,其在零样本设置下超越14个主流模型,全链条创新为视频检索通用化奠定基础。

量子位
开源动态8

中英双语、29项第一、像素级理解:360 FG-CLIP2登顶全球最强图文跨模态模型

360推出FG-CLIP2图文跨模态VLM模型,在八大类任务、29项测试中超越Google与Meta。它能像素级看图,中英文皆强且已开源。其优势源于高质量数据集和先进训练方法,还在多业务落地并开放API。

机器之心