「机器人视觉」共找到 1499 篇相关文章
5Y News|Kimi发布并开源 K2.5 模型,带来全新视觉理解、代码和Agent集群能力
2025年1月27日,月之暗面发布并开源Kimi K2.5模型,它是迄今最智能全能的模型,在多任务有出色表现。支持多模态输入,具备新能力,还推出Kimi Code工具,集群能力也开启Beta测试。
ICCV 2025 | 跨越视觉与语言边界,打开人机交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测
北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。
万人见证,“出轨”CEO被停职;陶哲轩评“OpenAI内部实验模型获IMO金牌”;传字节Seed视觉负责人“暂休”|AI周报
这是一篇AI行业周报,涵盖多领域热点。如Manus季逸超复盘Agent研发经验;陶哲轩评OpenAI模型获IMO金牌;字节跳动绩效改革、人员变动;还有企业动态,像英伟达黄仁勋访华、宇树科技开启上市辅导等。
大模型狂叠 buff、Agent乱战,2025大洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?
InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨大模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了大模型、Agent、AI Native等发展趋势。
互联网免费数据已被吃光,普通人反馈早没用了?前英伟达工程师:Transformer的原罪浪费算力,聊天机器人把GPU全糟蹋了
前英伟达工程师、Sail Research 创始人 Neil Movva 认为当前 AI 行业陷“延迟陷阱”,AI 终局应是后台 Agent。他执行“算力拾荒者战略”,想降低智能成本,还指出 Transformer 架构有缺陷,互联网数据被吃光等问题。
10岁孩子都能训机器人!对话松应科技创始人:做物理AI界的“安卓”挑战英伟达,正将其开源开放
松应科技创始人聂凯旋表示团队对标英伟达,四年达其主流能力,产品落地多家企业。松应发布 ORCA Lab 1.0 开发者版,降低具身智能研发门槛。其采用开放生态,构建数据策略,目标培养物理 AI 人才,推进自主创新。
黄仁勋凌晨炸场:6G、量子计算、物理AI、机器人、自动驾驶全来了!AI芯片营收已达3.5万亿|2025GTC超全指南
美东时间10月27日英伟达GTC大会开幕,黄仁勋演讲涉及6G、量子计算等热词。官宣与诺基亚合作建6G AI平台,还投资10亿美元。此外,英伟达AI芯片订单总额达5000亿美元,股价创新高。黄仁勋还阐述AI是新计算方式。
突然变强!速度翻4倍,GPT Pro惊现「神级」操作,网友怀疑GPT-5.5已就位
OpenAI悄悄完成GPT Pro模型升级,其速度提升、视觉理解能力增强。同时,代号「Spud」的GPT - 5.5已完成预训练,发布在即,AI竞争将更激烈。
OpenClaw烧光全球Token?追觅芯际穿越甩出太空芯,200万卫星叫板马斯克
文章介绍了芯际穿越的业务进展。该品牌规划200万颗算力卫星组成太空算力中心,超越马斯克的SpaceX。其产品涵盖泛机器人、手机处理器、自动驾驶芯片等,踩中国家级复合主航道。
ImageNet分数越高,生成反而越糊?iREPA给出解释
Adobe Research论文指出,视觉模型在ImageNet分类准确率高,生成效果未必好,全局语义强易压扁空间结构。iREPA修改REPA训练流程,削弱全局干扰,提升了生成质量。