联网能力」共找到 3221 篇相关文章

8

刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA

普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。

量子位
新闻资讯7

OpenClaw热潮之后,倒计时最后一天 | 线上预约、线下报名

OpenClaw热潮活动倒计时最后一天,由NICE、上海交大人工智能创新协会主办,2026.4.11 14:00 - 17:00举办。多位嘉宾分享,涉及Agent安全防御、智能体身份与通信、大模型进化及个人智能体发展等内容。

深度学习自然语言处理
算法论文8

VLA别再「走神」:即插即用提升视觉泛化,相对Pi0.5提升18%

至简动力、北大、港中文团队发现VLA模型深层动作预测对关键视觉区域依赖下降,提出DeepVision - VLA框架,在仿真和真实任务中效果显著,能有效提升视觉泛化能力

量子位
推荐文章7

编程 Agent 如何重塑工程、产品和设计

软件公司 EPD 目标是做出好软件,产出为代码。编程 Agent 让写代码变简单,使 EPD 角色定位改变,如 PRD 传统流程终结、瓶颈转向评审、通才更有价值等,各角色需适应新变化。

宝玉AI
推荐文章7

GAN之父Ian Goodfellow病后归来,剑指高效世界模型

GAN之父Ian Goodfellow等提出,利用符号化表示和游戏虚拟世界数据,或为构建动作条件多模态世界模型最佳路径,该模型可支持长时序任务预测与规划,还探讨构建原因、数据来源等。

机器之心
新闻资讯7

6张图看清中美AI竞赛:美国领先在哪,中国优势在哪

TIME杂志文章用六张图表解析中美AI竞争,指出美国在芯片控制、模型性能和商业变现领先,中国受算力瓶颈制约,但在人才基础和能源供给有优势,特朗普新出口规则或带来转机。

AI工程化
新闻资讯7

苹果重磅官宣谷歌Gemini 将支持 Siri,OpenAI 被边缘化?马斯克比奥特曼还急:这不合理!

苹果和谷歌官宣多年期合作,下一代 Apple Foundation Models 将基于谷歌 Gemini 模型及其云技术构建,为 Siri 等提供支持。此合作引发行业讨论,马斯克质疑其权力集中,也改变 OpenAI 在苹果生态的角色。

InfoQ
算法论文8

视觉模型既懂语义,又能还原细节,南洋理工&商汤提出棱镜假说

南洋理工与商汤团队提出 Prism Hypothesis(棱镜假说)与 Unified Autoencoding(UAE)。论文指出视觉基础模型中语义理解和像素保真很难兼得,用频率谱统一视角解决冲突,UAE 实验效果良好。

机器之心
产品应用8

阿里通义实验室出品!全新 GUI 智能体 MAI-UI,精准操控你的手机

阿里通义实验室推出 GUI 智能体模型家族 MAI - UI,覆盖多种规模。针对当前 GUI 智能体问题,采用统一方案让模型更强。在多项任务中刷新行业成绩,有性能提升与隐私保护双收益。

带你学AI
新闻资讯8

账号与身份防线全面失守:黑灰产 Agent 化攻击下,如何用“第一性原理”重建防线?

11月13日Anthropic报告显示,黑客利用AI Agent化能力发起复杂攻击,网络安全面临转折点。数美科技CTO梁堃指出黑灰产完成‘智能化’改造,传统防线失效,并提出防御方法。

InfoQ