深圳大学」共找到 551 篇相关文章

算法论文8

RSS 2025|物理驱动的世界模型PIN-WM:直接从视觉观测估计物理属性,可用于操作策略学习

国防科大、深圳大学、武汉大学团队提出物理驱动的世界模型PIN - WM,能从视觉观测辨识刚体物理属性。还提出PADC提升迁移性能,经实验验证其在非抓握式操作技能Sim2Real迁移中表现出色。

机器之心
开源动态8

RAG终极框架!港大开源RAG-Anything:统一多模态知识图谱

香港大学黄超教授团队发布开源项目RAG - Anything,构建统一多模态知识图谱架构,解决传统RAG技术局限。它能处理多类型异构内容,提供端到端方案,有多种优势及应用模式,还给出部署指南和未来展望。

新智元
新闻资讯8

瓦卡奖AI视觉创意大赛·从人工智能专家跨文化对话到全球AI厂商的竞技

10月17 - 19日,第二届瓦卡奖AI视觉创意大赛在深圳举行。期间AI全球视觉工作坊汇聚专家探讨AI与艺术融合,竞技日集结全球AI视频厂商民间团队参赛。大赛还发布国内首部《AI视觉创意应用蓝皮书》。

MANA新媒体艺术站
新闻资讯7

Forbes 报道:2.5 亿美元年化收入,硬件销量超百万,Plaud 是怎么赚钱的?

AI硬件创企Plaud创始人许高透露,公司年化收入将达2.5亿美元,约半数收入来自年度AI订阅服务。Plaud采用“深圳硬件+硅谷AI”模式,专注海外市场,以“硬件+软件订阅”盈利,同时面临大厂竞争。

Founder Park
新闻资讯7

The Batch: 865 | 机器人外科医生的切割与夹闭

约翰·霍普金斯大学等团队开发Hierarchical Surgical Robot Transformer(SRT - H),结合两个transformer模型,通过模仿学习训练,用达芬奇机器人完成胆囊切除关键步骤。虽在体外组织测试表现好,但应对人体手术仍有挑战。

DeeplearningAI
产品应用8

4K-Agent:可将低分辨率图像提升至4K高清智能体

图像超分辨率技术在多种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其多智能体架构能将低分辨率图像提至4K高清,在多领域测试表现出色。

AIGC开放社区
开源动态8

500美元刷新SOTA!训练成本砍到1/200,华人团队重构视频生成范式

香港城市大学等团队发布图像 - 视频生成模型Pusa V1.0,在基础大模型上引入VTA机制,用3860对视频 - 文字数据、约500美元微调,在I2V超越Wan - I2V - 14B实现SOTA,还解锁零样本任务能力。

量子位
开源动态8

对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA

浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,用双重注意力机制实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT - 4o等闭源系统。

新智元
新闻资讯7

CS博士求职8个月0 offer,绝望转行!斯坦福入学停滞,全美仅增0.2%

曾经热门的计算机专业渐成「冷门」,全美入学率仅增0.2%,斯坦福等校招生下滑。AI自动化初级编程岗位,致就业前景暗淡,如田纳西大学博士生求职8个月无果。不过也有人认为低迷或为短期,专家建议选培养可迁移技能学科。

新智元
算法论文8

19年不丢数据,擦写6万次不坏,原子级材料重新定义未来芯片

上海大学王震宇副教授团队在《自然·电子学》发文,用二硫化铌和二硫化钼做出新型非易失存储器,能保持数据约19年、擦写超6万次,还具备计算和存储两种本领,对未来低功耗计算和存内计算有吸引力。

DeepTech深科技