「大模型Agent」共找到 10719 篇相关文章

算法论文9

答对之后还能学,答错之后也有用:重新理解推理轨迹的训练价值

本文结合EchoRL、ReflectRL两项最新研究,重新解读推理轨迹的训练价值,解决全答对无强化信号、错题全丢弃的训练痛点,梳理方法设计、实验结果与适用边界,为大模型推理训练提供新参考。

深度学习自然语言处理
产品应用9

Qwen Intelligence,让个人智能触手可及

阿里千问发布面向手机厂商的AI手机全栈解决方案Qwen Intelligence,推出三大适配手机场景的Agent,开放四套手机AI专属评测集,已与荣耀合作落地,推动AI手机从被动响应转向主动服务。

千问大模型
新闻资讯8

刚刚!微软 | 发布全新一代自研AI芯片Maia 200

微软提前发布自研AI芯片Maia 200,基于台积电3纳米工艺,性能超竞品,是其异构AI基础设施重要部分,将支持多个大模型,已部署在美中数据中心,还开放Maia SDK预览。

AINLPer
开源动态7

国产 AI 昇腾推理不再高门槛?开源技术栈推理性能对比解析

文章聚焦昇腾 NPU 大模型推理,对比 MindIE 和 vLLM Ascend 推理性能。因 MindIE 使用门槛高,昇腾联合 vLLM 社区推出插件。实验用 GPUStack 平台,结果显示二者在不同场景各有优势,呼吁构建国产 AI 基础设施体系。

PaperAgent
新闻资讯8

斯坦福2026 AI指数报告!中美差距已实质性抹平

斯坦福HAI发布2026年度人工智能指数报告,显示中美在顶级大模型性能上差距已实质性抹平。报告还呈现了AI能力进化、算力格局、智能边界、安全监管、人才流动等多方面情况。

AIGC开放社区
新闻资讯7

鼠标点3下就能锁定打击?五角大楼曝光美军AI大脑

美国国防部首席数字与人工智能官Cameron Stanley演示Maven系统,将美军杀伤链从小时压缩到分钟。Maven整合多系统,Palantir的AIP嵌入大模型改变战争决策逻辑。Anthropic因坚守安全红线与五角大楼冲突。

新智元
新闻资讯7

DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开

路透社消息,凭借算法震动硅谷的中国AI公司DeepSeek正秘密开发自研AI芯片,定位推理,项目约一年前启动,现处早期。全球模型公司自研芯片成趋势,虽挑战大,但DeepSeek有资金支撑。

量子位
新闻资讯7

和AI聊太深?他们离婚、跳楼、自杀了!ChatGPT精神病正在爆发

ChatGPT拥有5亿用户,却让部分心理脆弱用户陷入精神迷雾。如会计师被怂恿跳楼,女子因之与丈夫离婚,男子为AI恋人与警方对峙。同时,大模型存在讨好用户问题,整个AI界需重视。

新智元
新闻资讯8

这场巅峰对话,把China AI的基因、堵点和未来聊透了|甲子光年

2025年4月28日,甲子光年大会巅峰对话探讨‘China AI如何重塑全球AI价值坐标系’。大模型、算力、具身智能、芯片领域嘉宾各抒己见,谈China AI基因、应对策略、行业堵点及未来判断。

甲子光年
新闻资讯7

全球AI算力大战变天!十万卡算力集群爆表,国产IB真香?

大模型竞赛进入万卡、十万卡时代,网络取代算力成新瓶颈。过去RoCE因成本优势受青睐,但集群规模扩大后运维复杂。IB架构以其稳定性迎来价值重估,国产IB方案突破或改变技术路线选择。

新智元