「具身感知」共找到 1278 篇相关文章
陶哲轩经费被断供,在线发帖自证数学有用
菲尔兹奖得主陶哲轩就职的UCLA科研经费被冻结,个人研究及应用数学研究所IPAM失去资金支持,还遭网友质疑其学术成果价值。他开新帖以“压缩感知”研究为例,力证数学研究回报,并将视野扩展到AI大模型。
攻克结构化长文档检索难题!新框架让模型告别“结构性失明”
SEAL团队推出全新对比学习框架SEAL,通过带结构感知和元素对齐,将文档宏观层级结构和微观元素语义融入Embedding空间,提升模型对结构化数据的理解。在BGE - M3模型上提升了MRR@10指标,还开源了万级字数长文档数据集。
评论送书 | 想系统了解AI?先搞清楚这四件事
文章围绕系统了解AI需搞清楚的四件事展开,介绍了AI理论基础层的机器学习和深度学习,感知交互层的计算机视觉等,应用实践层的机器人学等,还提及伦理社会层的AI伦理和社会影响研究。
终于,TRAE SOLO全量开放,我们用它复刻了PewDiePie的大模型智囊团
2025年AI Coding赛道上,TRAE是国产AI IDE代表作。7月其SOLO Beta版反响好,如今正式版全量推送。它定位为‘具备响应感知的编程智能体’,新增功能,还限时免费体验,实测显示开发能力强。
Figure抛弃10万行C++代码!用1000小时人类数据训练神经网络,实现全身控制基础模型
美国机器人公司Figure推出具身大脑Helix 02及家务demo。其搭载的Figure 03在厨房自主完成复杂任务,且实现端到端全身控制。新引入的System 0基于人类数据训练,替代大量手写代码,还展示多种灵巧操作。
GAIR 2025 大会首日:AI重构教育、科学与产业的十三重碰撞
2025年12月12日,第八届GAIR全球人工智能与机器人大会在深圳开幕。众多顶级学者围绕AI对教育、产业等领域的影响发表演讲与讨论,如赵伟院士提出高校“加减替换”培养模式,贾佳亚教授认为大模型将走向“感知机器+终身学习”模式等。
没想到,音频大模型开源最彻底的,居然是小红书
近几个月,开源成AI社区焦点,国内厂商七八月开源多款大模型,但音频生成占比小。小红书技术团队自去年起在音频领域稳定开源,成果覆盖TTS、ASR方向,具商用属性,降低落地门槛。
AI秒懂短视频,快手大模型Keye-VL理解力爆表!技术细节全开源
快手全新多模态大语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。
一张图生成任意场景3D模型,部分遮挡也不怕|IDEA x 光影焕像联合开源
IDEA研究院张磊团队与香港科技大学谭平团队联合推出SceneMaker框架,以DINO - X与Triverse为基础,实现从任意开放世界图像到带Mesh的3D场景完整重建,解决遮挡难题,有多项创新,应用场景广泛。
发生在CES的六场对话:来自深圳的 AI 硬件“外卷”
2026年CES上,中国硬件力量涌向全球。虽有地缘政治摩擦、签证障碍,但全球市场仍看好中国AI硬件。大厂将边缘硬件定义为AI生态入口,初创公司从数据、场景、交互寻生存之道,机器人应用场景也更明确。