通用智能体」共找到 3936 篇相关文章

算法论文8

演讲生成黑科技,PresentAgent从文本到演讲视频

联合团队提出 PresentAgent,能将长篇文档转化为带解说演示视频。采用模块化流程,还引入 PresentEval 评估框架。实验显示其接近人类表现,优于现有方案,展现了多模态智能潜力。

机器之心
新闻资讯7

程序员从此不再写代码!红杉专访Codex团队,o3白菜价真相曝光

红杉专访OpenAI Codex团队,揭示AI编程未来。Codex从代码补全演化为智能,强调委托心态,开发者从动手转向审核。还爆料OpenAI内部有递归自我改进的AI Alice。

新智元
算法论文8

医疗AI迎来大考!南洋理工发布首个LLM电子病历处理评测 | AAAI'26

南洋理工大学研究人员构建EHRStruct基准,涵盖11项核心任务、2200个样本,用于评测LLM处理结构化电子病历的能力。研究发现通用大模型优于医学专用模型,提出的EHRMaster框架与Gemini联合后性能超现有模型。

新智元
新闻资讯7

OpenAI自曝:AI推理砸钱越多,碾压人类越狠!

OpenAI研究员探讨推理模型时代。Noam Brown强调预训练和推理范式,指出当前AI胜在通用性。推理范式成本低、效果好,如o系列模型表现出色。首席经济学家谈AI经济影响,称其重塑企业格局。

新智元
产品应用8

前荣耀AI实验室主任带队:用“超级大脑”接管农场,24小时不打烊

浙江丘沃智能的AlphaFarm系统开启无人农场新范式,由前荣耀AI实验室主任汤泳等“AI极客”打造。该系统能自主决策执行、实时监控,有四大黑科技,经评估在农业垂直领域领先。

量子位
算法论文8

这个AI精准模拟人类行为大脑状态,上Nature了

德国团队开发出人类认知通用计算模型Centaur,登上Nature。它基于Llama 3.1 70B,用5天训练,参数仅Llama的0.15%,能模拟人类在160项实验中的行为,性能超传统模型。

量子位
算法论文7

AI如何看懂足球?上海交大团队打造Multi-Agent系统,全面解析“美丽足球”!

现有足球AI研究存在不足,上海交大团队打造Multi - Agent系统。他们构建SoccerWiki知识库、SoccerBench评测基准和SoccerAgent多智能系统,该系统多工具协作,实验中碾压GPT - 4,数据和代码将开源。

深度学习自然语言处理
产品应用7

Anthropic试图彻底杀死Harness Engineering。

Anthropic推出新产品Managed Agents,定位是帮用户做Harness。它指出Harness保鲜期短,自己维护不划算。技术上把Claude Agent SDK拆成三块,让Harness成可热插拔模块。不过通用Harness有局限,开源社区也有新路线。

探索AGI
新闻资讯7

具身导航:感知推理是上帝,还是执行控制是命门?| GAIR Live 023期预告

具身导航正从‘几何避障’向‘空间智能’跨越,当前领域经历范式变革。GAIR Live 023期线上圆桌将聚焦其前沿进展与落地问题,邀请两位专家拆解底层逻辑,还给出了核心议题、讨论精华预览及参与方式。

AI科技评论
产品应用7

Current Robotics 发布 Curr-0:以 Single Policy 实现全身灵巧操作

Current Robotics发布Curr - 0,解决人形机器人移动与操作分离困境。它用Single Policy统一训练,基于HumanEx采集数据,还构建多物理模态交互世界模型,是全栈具身智能基础设施成果。

AI科技评论