「视觉AI」共找到 10150 篇相关文章

算法论文8

ICLR 2026|在「想象」中进化的机器人:港科大×字节跳动Seed提出WMPO,在世界模型中进行VLA强化学习

香港科技大学 PEI - Lab 与字节跳动 Seed 团队提出 WMPO 新范式,可让具身智能在‘想象中训练’,解决传统 VLA 训练瓶颈,目前论文、代码与模型均已开源。

机器之心
产品应用8

完全取代Claude Code?OpenAI反击来了,推出Codex app「限时免费使用」

OpenAI推出macOS版Codex应用,反击Claude Code。它有全新交互界面,助开发者管理多AI Agents,支持并行任务。限时内,ChatGPT部分用户可免费使用,速率限制有调整,还具备多种新特性。

AI寒武纪
产品应用8

谷歌Alpha家族再登Nature封面!刷新基因组预测SOTA,精准定位远端致病突变

谷歌Alpha家族新成员AlphaGenome登Nature封面,将AI预测拓展到人类基因组图谱。它能综合预测11种基因调控过程,精准定位远端致病突变,性能超现有程序,已面向非商业研究开放API。

量子位
7

当英伟达收购Groq引发行业震动,中国存算一体赛道正在发生什么?|甲子光年

2025年底英伟达200亿美元收购Groq,让存算一体成产业刚需。传统GPU受存储墙限制,算力利用率低。Groq采用SRAM成本高,而亿铸科技以消费级显卡价格提供H卡性能,兼容CUDA,或成产业真需求。

甲子光年
8

从入门到用好 Agent Skills,看这一篇就足够了

文章是全面的 Agent Skills 中文指南,介绍其架构理念、机制、开发指南等。Claude Skills 价值被低估,它像通用 Agent 扩展包,非技术人员也能开发,还探讨了使用、开发时机与核心运行机制。

Founder Park
算法论文8

零样本&少样本横扫12个工业医疗数据集:西门子×腾讯优图新研究精准定位缺陷,检测精度新SOTA丨AAAI 2026

西门子与腾讯优图联合团队提出AdaptCLIP通用视觉异常检测框架,不改动CLIP主干,引入轻量适配器。它兼容零样本/少样本推理,在12个数据集评估表现优,兼顾精度与部署需求。

量子位
新闻资讯7

OpenAI开启“印钞机”模式?ChatGPT官宣引入广告,新增8美金/月Go版低价订阅服务

OpenAI宣布广告业务要来了,其低成本订阅服务ChatGPT Go将登陆美国及所有ChatGPT可用地区。未来几周将在美国免费版和Go版中测试广告,Pro、Business和Enterprise订阅方案无广告。还明确广告业务五大原则。

AI寒武纪
新闻资讯7

“心内推理”:一种动态多模态潜在空间推理范式 | 直播预约

当前多模态大模型推理效率低、稳定性不足。本次分享将介绍DMLR,它无需额外训练,仅在推理阶段生效,通过在潜空间优化潜在思考token、引入关键视觉信息,实现高效稳定的多模态推理。

深度学习自然语言处理
产品应用8

让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master

科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。

机器之心
开源动态8

医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗大模型正式开源,登顶权威榜单

2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗大模型或成最优解,它参数量大,在多评测中登顶,技术优势明显。

机器之心