「多模态技术」共找到 3527 篇相关文章
独家|智元成立灵巧手子公司「临界点」,前腾讯Robotics X 熊坤带队
AI科技评论独家获悉,智元机器人拆分灵巧手业务成立新公司「临界点」并完成首轮融资,由熊坤带队。智元过去一年投资活跃,拆分或因技术门槛高、应用广,且自身有技术积累。
全国首部可信AI“技术安全+数据合规”标准来了,欢迎参与起草!
2025年国家数据局开展可信数据空间试点,在多领域落地经验。但实践中出现技术与标准等问题,中国电子商会归口、智合标准中心组织起草《人工智能大模型可信数据协作安全与合规指南》,介绍标准内容、亮点等并征集起草单位和起草人。
国内首篇!融合语言模型的多模态触觉传感器,推动机器人触觉迈向人类水平
清华大学丁文伯团队联合多机构,受鸽子感知机制启发研发仿生多模态触觉传感器 SuperTac,构建 8.5B 参数触觉语言模型 DOVE,成果发表于《Nature Sensors》,推动机器人触觉迈向人类水平。
中际旭创市值6000多亿背后:技术卡位,一场“蛇吞象”跨界豪赌
A股“易中天”组合里,中际旭创营收和市值居首。其前身中际装备业绩不佳,66岁创始人王伟修2016年“蛇吞象”收购旭创科技,后交棒刘圣。9年营收增180倍,如今稳坐全球光模块厂商第一,还成巨头核心供应商。
Agent项目最头疼的不是技术,这可能是近期最棒的Agent调研。
MMC深入访谈多家AI Agent创业公司创始人和企业用户,撰写《State of Agentic AI: Founder’s edition》。调研显示创始人头疼的多是非技术问题,还分析了准确率与主动性、定价策略等情况。
理解、生成、编辑一次搞定:Skywork UniPic 2.0的统一多模态解法|甲子光年
电商团队常面临创作流程繁琐问题,当前行业需统一架构。昆仑万维发布Skywork UniPic 2.0,整合理解、生成、编辑功能。它参数小性能优,还构建奖励模型,配合其他模型构建体系,具成本等优势。
只剩5年?诺奖得主Hassabis放出AGI时间表:还差一两个技术突破
诺奖得主、Google DeepMind掌门人Demis Hassabis给出AGI终极时间表,认为5年内或需1-2项重大技术突破就能跨越障碍。他指出大模型有局限,实现AGI需“世界模型”和“智能体系统”,还称AI将加速科学发现,中国AI模型距美国仅差数月。
具身智能:当钱成为记分牌,重资产开始翻盘
2026 年上半年具身智能赛道火热,超 460 亿资金涌入,25 家成百亿独角兽。融资额成竞争指标,虽行业长期需求真实,但短期估值与技术有缺口,热潮或催熟相关技术和供应链。
多模态大模型中Attention机制暗藏「骗局」,需用一个公式修正丨上大×南开
上海大学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。
李飞飞团队新作:DiT不训练直接改架构,模型深度减半,质量还提高了
本文介绍「嫁接」技术,可在小计算预算下编辑预训练 DiTs 探索新架构。不从头训练,替换算子创建混合架构,保持质量同时减少计算量。还通过实验展示该技术在构建高效架构和文生图模型中的效果。