「新需求」共找到 4202 篇相关文章
斯坦福洗碗机器人新作!灵巧手跟人学采茶做早餐,CoRL 2025提名最佳论文
斯坦福等机构提出DexUMI框架,利用人手将操作技能迁移至灵巧手。该框架通过软硬件创新缩小人手与灵巧手具身差异,在两款灵巧手硬件平台验证,平均任务成功率达86%,数据采集效率提升3.2倍,被CoRL 2025提名最佳论文。
超越AlphaFold 3!ProRNA3D搞定RNA蛋白互作,攻克癌症、病毒有了新武器
弗吉尼亚理工Debswapna Bhattacharya团队开源AI工具ProRNA3D - single,能仅靠单条蛋白质和RNA序列预测二者复合物三维结构,超越AlphaFold 3等工具,基于生物语言模型,有诸多应用价值,也有改进方向。
AI终端驱动下的芯片产业:新周期的起点与方向|甲子引力X
在8月21日的投资大会上,六位半导体领域顶级投资人剖析AI时代芯片破局路。他们认为中国虽在核心制造与软件生态是“跟随者”,但贴近终端等构成独特优势,还探讨突破壁垒、应对困境之法及未来投资方向。
00后8亿美金「掀桌」!硅谷AI将书写影视新传奇,终结制片旧时代
00后华人女CEO Cecilia Shen带队转型Cybever为全球首家AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术从3D虚拟环境生成发展到完整视频制作,还推出两部大作,或改变影视行业格局。
全球首个人形机器人通用视觉感知系统,Humanoid Occupancy建立多模态环境理解新范式
北京人形机器人创新中心推出 Humanoid Occupancy 感知系统,创新性融合多模态传感器信息,构建通用感知框架。它以语义占用表征为核心,有全编码和适配融合优势,经实验验证性能优,推动机器人迈向通用感知时代。
国产AI首次「长出」原生记忆,非Transformer架构成新王!机器狗当场引爆WAIC
WAIC世界人工智能大会上,国产黑马RockAI的大模型Yan 2.0 Preview亮相,可多终端无损部署。它基于非Transformer架构,训练效率高,有原生记忆,实现端侧AI,展现出自主学习和多模态能力,引发关注。
“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!
7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。
美团提出多模态推理新范式:RL+SFT非传统顺序组合突破传统训练瓶颈
美团研究者提出Metis - RISE框架,将RL激励和SFT增强以非传统顺序结合提升多模态大语言模型推理能力。先RL激发潜能,再SFT补齐短板,训练的两模型在OpenCompass榜单成绩优异。
1万tokens是检验长文本的新基准,超过后18款大模型集体失智
Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。
UIUC提出隐式监督新范式:无需标注/RM即可全面提升多模态Reasoning的感知能力
大型多模态模型在复杂多模态推理中面临挑战,67%错误源于视觉感知缺陷。为此,UIUC提出PAPO,通过隐式感知损失提升模型感知能力,无需额外标注,在多模态基准上表现优异,还解决了KL黑客问题。