环境光感知」共找到 869 篇相关文章

开源动态7

挑战 Claude Code,9.5 万星!又一款开源 AI 编程神器火了

开源AI编程工具OpenCode亮相,具备原生终端界面、多会话支持,兼容75种以上模型,提供桌面版和IDE插件。它允许沿用付费订阅,内置免费模型,与多种LSP服务器整合,适配多种编辑器,采用‘隐私优先’架构设计。

InfoQ
开源动态8

仅 3MB 大小,终端极速预览 word!

开发者等常需在服务器或命令行环境查看Word文档,传统方式低效。开源神器doxx基于Rust开发,无需Microsoft Word等软件,有保留格式渲染、全文搜索等功能,还提供多种安装渠道。

开源先锋
产品应用7

谷歌用一堆不赚钱的AI小玩意,给科技圈上了一课

谷歌Arts & Culture网站有不少艺术实验项目,从商业看无直接价值,但藏着人文坚守。如Botanic Atlas、Art Palette等,用技术拓展感知文化方式,消解艺术与大众的隔阂。

机器之心
算法论文8

大模型被确诊「视觉文盲」!多校联合提出MILO,为它植入空间想象力

空间推理是多模态大语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。多校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五大任务验证其有效。

量子位
新闻资讯8

爆发力超越波士顿动力液压机器人,PHYBOT M1实现全球首次全尺寸重型电驱人形机器人完美拟人态后空翻

动易科技的全尺寸人形机器人PHYBOT M1实现全球首次全尺寸重型电驱机器人完美拟人态后空翻,其爆发力超波士顿动力Atlas。这是对其动态性能的压力测试,电驱系统也在多方面超越液压方案。

量子位
开源动态7

让 AI 像真人一样操控手机完成各种复杂任务

MobiAgent是强大的移动端智能体系统,含智能体模型家族、加速框架、评测基准。能让AI像真人操控手机完成复杂任务,提供开箱即用App,内置经验检索模块可自动优化规划。

GitHubStore
算法论文8

RL成本降幅超90%!Meta提出Agent训练新范式DreamGym

传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。

深度学习自然语言处理
新闻资讯7

Meta 系 95 后华人明星团队,创业一年就与高通达成合作,让手机拥有多模态记忆

由华人创业者沈俊潇创办的 Memories.ai 发布 LVMM 2.0 并宣布与高通合作,该模型 2026 年将在高通处理器上原生运行。它解决视频可搜索性问题,应用广泛,能降低延迟、确保数据安全等。

Founder Park
产品应用8

更先进的AI,就应该发生在“今天” | 甲子

AI应用离消费者体验还有距离,行业分歧加剧。9月22日,联发科发布天玑9500芯片,把AI嵌入端侧设备,在高频场景优化体验,还在芯片设计、硬件创新上突破瓶颈,带动伙伴发展,推动AI普及。

甲子光年
算法论文8

NeurIPS Spotlight|运动遮挡都不怕,0先验、一段视频精准预测相机参数

论文一作李放等为解决传统方法在动态场景预测相机参数的难题,提出 ROS - Cam 方法,涵盖补丁式跟踪滤波器、异常值感知联合优化、双阶段训练策略,代码即将开源。

机器之心