大模型智能体」共找到 10598 篇相关文章

8

超越英伟达B200!AMD最强AI芯:1.6倍内存、模型推理快30%,奥特曼都来站台

AMD发布最强AI芯片MI350X和MI355X,号称模型推理比英伟达B200快30%,内存是其1.6倍。该系列本月初已批量出货,还发布ROCm 7软件栈。AMD还预告明年推MI400系列,由其与OpenAI联合研发。

量子位
新闻资讯7

Meta超级智能实验室重组为四个部门,某些高管将离开

据《彭博社》报道,Meta 将重组超级智能实验室及相关 AI 部门为四个新部门,某些高管预计离职。Meta 此前力挖角,此次或从依赖内部开发转向集成第三方模型,扎克伯格强调对超级智能的推动。

机器之心
算法论文8

均值至上假繁荣!北新作专挑难题,逼出AI模型真本事

当强化学习成模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三任务表现优异。

新智元
开源动态8

五百行代码打造SOTA视觉智能体!UniPat AI最新开源

多模态模型代码能力强,但基础视觉任务常失误。UniPat AI推出极简视觉智能体框架SWE-Vision,让模型用代码弥补视觉短板,在五个主流视觉基准测试达最优。该框架设计独特,开源代码和数据已发布。

量子位
开源动态8

没想到,最Open的开源新模型,来自小红书

向来低调的小红书昨日开源首个自研模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
新闻资讯8

李飞飞的World Labs联手光轮智能,具身智能进入评测驱动时代!

李飞飞旗下World Labs与光轮智能联手,瞄准具身智能「规模化评测」问题。World Labs的Marble是生产力工具,而光轮智能有自研仿真技术体系,双方合作让规模化评测成为可能,具身智能迈入评测驱动时代。

量子位
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强泛化能力。

量子位
算法论文8

给定"标价"的 LLM 智能体,能规划出"最优"路径吗?

在LLM智能体多轮工具使用中,评估成本是难题。来自多所高校的团队推出CostBench基准,围绕旅行规划构建评估环境。评估顶尖模型发现其规划与适应能力有短板,并分析失效根源,还指出下一代智能体演进方向。

深度学习自然语言处理
新闻资讯8

炸裂!Claude以第一作者写论文反驳苹果「推理模型根本没有推理能力」:苹果有三错误

苹果论文称推理模型无推理能力,引发争议。Anthropic的Claude Opus以第一作者写论文反击,指出苹果研究有混淆‘推理失败’与‘输出截断’等三问题,还通过实验证明模型能力,强调需更聪明评估方法。

AI寒武纪
开源动态7

超越ZIP的无损压缩来了!华盛顿学让模型成为无损文本压缩器

华盛顿学SyFI实验室提出LLMc,利用型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。

量子位