通用智能体」共找到 3904 篇相关文章

算法论文8

LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力

来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
开源动态8

红杉中国xbench全球首发,AI智能真实战力揭榜!

红杉中国推出全新AI基准测试工具xbench及相关论文,采用双轨评估系和长青评估机制,首期发布两个核心评估集并综合排名,还提出垂类评测方法论。它能追踪模型能力与实际场景价值,解决现有评估难题。

新智元
开源动态8

中科院开源PPT Agent,一键自动生成PPT智能

中科院软件所等联合开源PPT Agent,它能分析参考幻灯片,按人类流程分两阶段生成PPT,有自我修正功能,测试显示在多维度优于现有方法,极大节省用户时间精力。

AIGC开放社区
新闻资讯8

英伟达通用机器人芯片来了:AI算力提升7.5倍,宇树、银河通用已搭载

本周一,英伟达发布新一代机器人专用芯片Jetson Thor,算力是上一代7.5倍,能效3.5倍,内存容量翻倍。适配新算法,支持多种模型,已受大量厂商重视,相关产品已发售或开放预订。

机器之心
开源动态8

本地运行、支持视觉与工具调用:Meta 开源智能模型

Meta AI Research 推出 300 亿参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可证。它专为本地工作流设计,能在消费级硬件运行,经多项优化,在基准评估中表现出色,还支持多种框架。

AI前线
算法论文8

终于学会“复盘”了!让智能从“解题”进化到“进化”!

上海AI Lab和新加坡国立大学推出新框架RETROAGENT,让AI Agent学会“复盘”。它通过双重内在反馈复盘,提出SimUtil - UCB策略查记忆,在多项任务中碾压基线模型,使Agent从解题进化到进化。

深度学习自然语言处理
开源动态8

首个开源多模态Deep Research智能,超越多个闭源方案

首个开源多模态Deep Research Agent登场,整合多种工具并优化决策。其WebWatcher技术方案覆盖全链路,实验中在四大核心领域领先主流模型,展现复杂推理和信息检索实力。

量子位
新闻资讯7

GAIR Live 预告|世界模型——通向通用智能的关键拼图

随着AGI议题升温,‘世界模型’成前沿焦点。GAIR Live将邀顶尖学者与专家,探讨其定义、趋势等问题,还有直播议题如Lecun观点看法、不同领域世界模型差异等。

AI科技评论
新闻资讯8

ChatGPT智能正式发布,多个创业赛道昨夜无眠

OpenAI正式发布ChatGPT Agent,将思考与执行能力统一,可接管电脑,能处理工作和生活多种事务。它优化后能力达SOTA,但也有风险。这或重塑互联网,让Agent创业者重新审视竞争力。

量子位
新闻资讯8

2026年具身智能进入“上市大年”

2026年开年不到三月,具身智能赛道涌入200亿热钱,7家企业成百亿估值独角兽,超20家明确上市计划。虽2025年该领域有泡沫成共识,但因政策加持、技术突破等因素,投资机构仍重金下注。行业格局分六大派系。

芯师爷