「视觉分析」共找到 1729 篇相关文章
人形机器人规模化前夜,硬件供应链是真正的深水区
过去三年,人形机器人行业投资火热,但供应链瓶颈成商业化关键制约。麦肯锡报告分析成本结构,指出执行器是成本大头且供应体系不成熟。全球供应风险分三档,中国供应链有优势,2035年格局或转变。
5月半导体产业涨价信息全景图!
2026年半导体行业涨价潮席卷全产业链,受AI超级周期与上游金属成本高企影响,存储芯片、MCU等器件及代工、封测服务等均涨价。文章梳理开年至今行业涨价信息,还分析原因及对终端市场的影响。
数GPU,看未来:一张表看懂中美AI公司的真实实力差距,算力盘点
文章全面盘点中美头部AI公司GPU数量、资本开支和算力规划。美国科技巨头疯狂投入,如Meta、微软等;中国公司在禁令下抢购囤货并加速国产替代,如字节跳动、阿里等。还分析了中美差距及投资关注点。
无需训练,如何提升黑箱VLM?CARPRT用「类别感知」给出答案
近年来,视觉 - 语言模型(VLMs)改变图像理解范式,但零样本分类性能对 Prompt 敏感。墨尔本大学 TMLR 小组提出 CARPRT 方案,以“无训练、黑箱适配、类别专属权重”解决提示词语义适配不足问题,已被 ICLR 2026 接收。
一种可以减少 CI 回归测试套件规模的更佳方案
作者作为测试架构师,认为减少CI回归测试套件规模理论诱人但实践常失望。介绍有效处理大型测试套件的方案,如随机趋势分析、多上下文模式匹配等,还谈及无门控测试等优势,能助力管理测试集。
刚刚,Cursor被扒底裤!Claude Code套壳实锤,500亿估值全靠Ctrl+H?
知名开发者逆向分析发现,Cursor 3.0实锤套壳Claude Code,将其包装成「自主研发」。Cursor官方称是A/B测试,但证据显示更像正式集成。此事折射出AI应用层困境,应用层玩家只能在「外围战场」厮杀。
当心!腾讯、字节等揭示,OpenClaw有无法修复的安全死结
加州大学等机构团队发布对OpenClaw安全的深度分析报告。它是广泛部署的个人伴侣智能体,运行依赖进化理念,但记忆文件成攻击入口。研究在真实网络测评,发现其安全漏洞大,且难以找到进化与安全的完美平衡。
93%的人在用AI,为什么生产力只提升了10%——两个被严重低估的杠杆
Stack Overflow 2024年调查显示93%开发者用AI辅助工具,但DX Research研究表明生产力仅提升约10%。文章指出多数人用AI是线性叠加,真正的乘数效应来自自闭环验证和长期记忆,还分析误区并给出实践路径。
ICLR 2026 | 机器人不够聪明?VLMgineer让大模型自己「发明工具」,从设计到使用全自动
宾夕法尼亚大学研究者提出 VLMgineer,一个全自动工具设计与使用框架,利用视觉语言模型和进化搜索,让机器人自主设计并使用工具。该工作已被 ICLR 2026 接收。实验显示,它在工具设计上优于人类提示和现有 Benchmark 工具。
李飞飞World Labs最新判断:AI写完代码,下一步是「写世界」?
这篇来自 World Labs 的博客探讨了 AI 参与空间创作和现实世界任务时的通用接口,认为是 3D 。它像代码一样可结构化表达,还分析了神经图形学、模拟引擎的作用,并介绍了相关项目。