「感知核心」共找到 1907 篇相关文章
MiniMax开源首个视觉RL统一框架,闫俊杰领衔!推理感知两手抓,性能横扫MEGA-Bench
MiniMax开源首个视觉RL统一框架V-Triune,由闫俊杰领衔。该框架通过三层组件设计和动态IoU奖励机制,让VLM能联合学习推理和感知任务。还开发Orsta模型系列,在MEGA - Bench表现出色,且MiniMax多模态布局动作多。
Figure 03重磅发布!指尖能感知回形针重量,年产1.2万台,这次要让人形机器人走进千家万户
Figure AI公司发布第三代人形机器人Figure 03,专为Helix、家庭和大规模应用设计。它有全新传感与手部系统,能感知回形针重量,还做了安全、易用设计,实现低成本量产,适用于家庭和商业场景。
泛娱乐 AI 赛道观察: 从「猜你喜欢」到参与共创,角色才是 AI 时代最核心的资产
文章围绕AI泛娱乐产品展开,指出AI时代产品观应从二元对立转为三元共生。AI可实现个性化体验,从“猜你喜欢”到“与你共创”。还分析了不同体验心态及案例,强调角色是核心资产,未来产品可降低门槛、扩圈发展。
Nature公开谷歌IMO金牌模型技术细节!核心团队仅10人,一年给AI编出8000万道数学题训练
谷歌DeepMind的IMO金牌模型AlphaProof技术细节公开。团队规模小,核心成员是IMO金牌得主。它把数学证明当游戏,用30亿参数模型和改进树搜索算法。训练难题靠自动形式化解决,赛场用TTRL突破,已开放使用。
全靠Claude Code 10天赶工上线,Cowork 删用户11G文件不含糊!核心研发:长时间打磨再发布很难成功
Anthropic发布的Claude Cowork研究预览版问题频出,如删用户文件、易受文件窃取攻击等。与Claude Code相比,它交互繁琐、效率滞后。不过其核心研发认为长时间打磨再发布难成功,未来将以用户反馈迭代。
“你以为买的是 DeepSeek Flash,到手可能是 1.5 bit 缩水版”:Pi 核心贡献者谈 AI Token 黑箱
Pi 核心贡献者 Armin Ronacher 与 Modem 联合创始人 Ben Vinegar 播客对谈指出,当前 AI token 市场不透明,模型公司或失控。如买 token 像买成分不明商品,模型训练目标不明,且 Agent 行为边界在扩展,问责制缺失。
AMD 苏妈对话李开复:AI 转型只能由 CEO 驱动、未来“DRI”(直接负责人)将是企业核心|直击现场
2026 AMD AI 开发者日上海站,AMD 苏姿丰阐述 AI 愿景及中国战略。她与李开复对话,李开复认为 AI 跨越编程临界点,多智能体架构是突破,AI 转型需 CEO 驱动,未来 DRI 将成企业核心。
ICCV 2025 | 跨越视觉与语言边界,打开人机交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测
北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。
全靠Claude Code 10天赶工上线,Cowork 删用户11G文件不含糊!核心研发:长时间打磨再发布很难成功
Anthropic发布的Claude Cowork研究预览版问题频出,如删用户文件、窃取文件。与Claude Code对比,它交互繁琐、效率滞后。不过核心研发称快速上线再迭代,未来Agent类应用界面会趋简,Skills是关键。
T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」
在具身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。