目标识别」共找到 804 篇相关文章

开源动态8

浙大开源PhyEdit:单图编辑+精准3D物体操作 | ACM MM'26

浙江大学ReLER团队开源的PhyEdit,用3D foundation model明确目标几何,让DiT图像编辑器负责最终渲染。单张图片里物体能移动并形成连续状态,在多项指标表现出色,还具备多种能力,已被ACM MM 2026接收。

新智元
开源动态7

这个开源项目把视频处理与投稿接成一条流水线

Y2A-Auto是面向YouTube、AcFun和bilibili的自动化处理工具,将下载、识别、翻译等操作集成到Web管理后台。用户可手动或自动处理,支持多平台投稿,有多种功能和灵活配置,适合持续处理授权内容的用户。

GitHubStore
新闻资讯7

AI消灭感冒被提上日程,Anthropic和OpenAI罕见联手

全球支付巨头 Stripe 投资 5 亿美元建立非营利组织 Intercept,目标是解决呼吸道感染问题。Anthropic、OpenAI 等机构和个人也参与支持。Intercept 从广谱预防药物和空气净化杀菌技术两方面着手,科技公司也将提供技术助力。

DeepTech深科技
算法论文8

从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026

浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。

AI科技评论
新闻资讯8

硅谷这一夜,属于中国机器人!图灵奖得主、英伟达大牛全来了

美西4月28日,具身智能全球性峰会GEIS在硅谷落幕。中国公司魔法原子发起,图灵奖得主演讲,英伟达等科学家对谈。会上发布世界模型Magic - Mix、灵巧手H01和人形机器人MagicBot X1三款产品,展现全栈自研实力。

新智元
新闻资讯7

对话地平线前高管牛建伟:万亿参数大模型如何重塑具身智能

具身智能赛道分“VLA派”“智驾降维派”和“大模型派”。地平线前高管牛建伟认为VLA是弯路,主张用分层架构,以万亿参数“空间智能大模型”做大脑,VA小模型执行操作,目标是做物理世界的OpenClaw。

AI科技评论
算法论文8

大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练

字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。

量子位
产品应用8

给 OpenClaw 再加一道安全护栏

为保障智能体安全,开发了SKILL,覆盖安装前到运行中的全生命周期。安装前进行九类风险检查,运行时有guard机制,从六个方面看风险,设四层风险分级和输入信任等级,目标是让智能体更可控。

深度学习自然语言处理
开源动态8

TabClaw:让 AI 真正读懂你的表格数据

TabClaw 是面向表格数据的 AI 分析 Agent,能让 AI 真正读懂表格数据。它核心标签是全透明与持续进化,工作流分显式和隐式两层,目标是成为真正理解用户、能一起成长的表格分析伙伴,项目已开源。

PaperAgent
推荐文章7

面向 AI Agents 的高性能数据基座:架构和工程实践

在 QCon 全球软件开发大会上,晨章数据创始人陈亮分享了面向 AI Agents 的高性能数据基座。他指出 AI Agent 驱动的应用带来数据挑战,提出多模态数据基座设计目标,并介绍工程实践,证明传统架构有 CPU 瓶颈。

InfoQ