「类脑视觉技术」共找到 3369 篇相关文章
Kimi K2技术报告正式发布:“保姆级”深度解析,一文读懂万亿参数智能体的所有秘密
Kimi K2技术报告发布,Moonshot团队用万亿+参数稀疏MoE架构等打造接近Claude - Opus的通用大模型。围绕训练稳定性等改进,有预训练、架构设计等多方面创新,为智能体领域提供可行路径。
亚马逊云科技大中华区总裁储瑞松:企业实现 Agentic AI 价值的关键在于三大技术准备
亚马逊云科技大中华区总裁储瑞松在峰会表示,正处 Agentic AI 爆发前夜。其爆发源于大模型能力发展、协议出现、推理成本降低等因素。企业实现其价值需做好三大技术准备,还推荐了 6 月 27 - 28 日的 AICon 北京站活动。
鸿蒙元服务的“体验密码” | 从京东到深圳万象城,看技术底层如何让服务直达用户
AI时代,系统能感知用户场景与需求,主动推送服务。鸿蒙元服务解决用户体验痛点,其技术底座帮开发者“减负”。如京东复用代码,深圳万象城优化停车服务,还为中小商户提供零代码开发方案。
能效翻5倍!他们复刻人脑双记忆通路,造出能长效记住上下文的类脑AI芯片
帝国理工学院博士后孙鹏飞和苏黎世联邦理工博士后苏哲及合作者,受大脑皮层机制启发,打造“双重记忆路径”类脑网络及配套芯片,处理语音识别任务时能效比此前优方案高5倍。相关论文发表在《自然·机器智能》且代码、设计全开源。
破解在线长时序重建难题!纯视觉、单卡实时的公里级流式3D重建|CVPR'26
在自动驾驶等领域,长序列3D重建落地难,存在精度退化等问题。即将到来的CVPR 2026中,LongStream模型开源,它重新设计,解决了长序列难题,在多基准测试表现强,推动3D视觉走向在线建模。
首篇自进化智能体系统技术报告出炉:Token成本直降近10倍,省钱又高效!
全球首个基于‘上下文信息密度最大化’的自进化智能体系统GA发布技术报告。它在多基准测试表现惊艳,能省近10倍Token,还能自我进化。报告深度解读设计理念,剖析自进化能力与智能体设计思路。
ICLR 2026 | 这道题是否需要用图思考?模型来告诉你!自适应思考模式切换助力通用视觉推理提升
本文来自复旦大学和阿里巴巴未来生活实验室,已中稿 ICLR 2026。目前视觉推理方法有纯文本和用图思考两种模式,各有优劣。研究者提出 Mixture-of-Visual-Thoughts 范式及 AdaVaR 框架、AdaGRPO 算法,让模型自适应选模式,实验显示其在多任务有提升。
智能体工程的隐形技术债:10分钟造出一个 Agent,公司却要为它养一个平台团队
如今构建智能体容易,但投入生产后会面临诸多问题。文章围绕智能体绘制出集成、上下文湖等七个基础设施模块,分析各模块隐性技术债务,并指出不同阶段债务表现,还提及应对措施及相关会议推荐。
RSS 2025|物理驱动的世界模型PIN-WM:直接从视觉观测估计物理属性,可用于操作策略学习
国防科大、深圳大学、武汉大学团队提出物理驱动的世界模型PIN - WM,能从视觉观测辨识刚体物理属性。还提出PADC提升迁移性能,经实验验证其在非抓握式操作技能Sim2Real迁移中表现出色。
智元启动「买买买」,路径未明,资本抢跑,主流技术范式下谁在领跑具身智能赛道?
2025年7月,智元机器人21亿现金收购上纬新材,成A股首个“具身智能概念”上市公司,引发行业震动。具身智能技术尚在演进,业内从多方向构建系统,主流路径有端到端大模型体系和双系统架构。