「手机智能体」共找到 5249 篇相关文章

新闻资讯8

李飞飞的World Labs联手光轮智能,具身智能进入评测驱动时代!

李飞飞旗下World Labs与光轮智能联手,瞄准具身智能「规模化评测」问题。World Labs的Marble是生产力工具,而光轮智能有自研仿真技术体系,双方合作让规模化评测成为可能,具身智能迈入评测驱动时代。

量子位
新闻资讯8

阿里千问落地谷歌UCP+A2UI,中国率先进入AI办事时代

谷歌联合零售巨头发布UCP和A2UI协议,试图定义智能体商务全球标准。而阿里千问App上线千问任务助理1.0,打通淘宝、支付宝等核心业务,接入多项生活与政务服务,快速落地应用,让中国进入AI办事时代。

AIGC开放社区
算法论文8

CMU&NYU最新工作解释:存储在权重里的“智能”是从哪来的?

论文《From Entropy to Epiplexity》指出经典信息论在AI面前有三大悖论,提出用Epiplexity度量信息。它将数据信息拆为Time - bounded Entropy和Epiplexity,通过神经网络训练近似计算,实验验证其有效性,并给出启示。

深度学习自然语言处理
新闻资讯7

Manus走了,原生Agent登场:“AI助手”的第三次重新定义

文章回顾“AI助手”三次预期校准,指出Manus完成Agent启蒙使命,随后分析Agent发展现状,提到其将从炫技到日常,还指出Chat时代落幕,中国模型创业者正加速,探索谁能成“中国的Anthropic”。

AI科技评论
开源动态8

Transformers v5 中的分词系统:更简洁、更清晰、更模块化

文章聚焦 Transformers v5 分词系统,介绍分词概念、流程、主流算法,对比 transformers 和 tokenizers 库。着重讲 v5 改进,如架构与词表分离,解决 v4 黑盒问题,还能从零训练专属分词器。

Hugging Face
开源动态8

顶尖AI竟输给三岁宝宝,BabyVision测试暴露多模态模型硬伤

UniPat AI 等发布多模态理解评测集 BabyVision,测试显示多模态大模型纯视觉能力仅达三岁幼儿水平。其通过对比实验、细分任务评测,揭示模型系统性缺基础视觉能力,还给出新方向及发展建议。

AINLPer
开源动态8

阿里通义开源GUI智能体SOTA:2B到235B端云协同重新定义移动端GUI智能体

阿里通义实验室开源MAI - UI,通过端云协同架构等解决GUI智能体部署难题。它全谱系模型设计应对硬件约束,自进化数据管线和在线强化学习提升性能,端云协同平衡隐私与效率,扩展动作空间打破局限,在多基准测试创SOTA。

AIGC开放社区
算法论文8

AI4S回归白盒符号主义,清华等联合发布SR-LLM:自主发现科学知识

清华大学等多所高校联合发布SR - LLM,这是融合大语言模型与深度强化学习的符号回归框架。它从数据生成可解释数学模型,在跟车行为建模等任务表现优,为机器自主科学发现开辟新路径。

新智元
新闻资讯7

OpenAI这招太狠!AI从「躲猫猫」到「自爆黑料」,主打一个坦白

随着AI进入高风险场景,透明、安全变得重要。OpenAI提出「忏悔机制」,让模型回答后产出自我坦白报告,不影响主回答评分,只考察诚实,能提升不良行为可见性,目前仍处概念验证阶段。

新智元
产品应用8

AgentScope x RocketMQ:打造企业级高可靠 A2A 智能体通信基座

文章介绍 Apache RocketMQ 新推的 LiteTopic 通信模型,能简化 AI 系统架构、提升稳定性。结合 A2A 协议与 AgentScope 框架案例,剖析智能体通信实践与技术实现,还给出构建多智能体应用的实战方案。

阿里云开发者