LLM智能体」共找到 4257 篇相关文章

新闻资讯8

HBM Roadmap和HBM4的关键特性

文章介绍 KAIST TERALAB 公布的 HBM 技术,涵盖 HBM 路线图和 HBM4 特性。HBM 路线图展示从容量升级到计算存储融合的进化,HBM4 在电气规格、封装冷却、架构等方面有突破,AI 工具也用于研发。

芯师爷
开源动态8

不用千亿参数也能合成高质量数据!这个开源框架让小模型“组团逆袭”,7B性能直追72B

上海人工智能实验室与中国人民大学提出GRA框架,以“多人协作”理念让小模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对大模型蒸馏依赖,展现“集智能”潜力。

量子位
新闻资讯7

新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了

“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最新版Qwen和DeepSeek R1对比。该模型亮点是支持多语言推理,以纯RL方式训练,为LLM强化学习提供新范式。

量子位
新闻资讯7

新赋能•创生态 | 首钢园“产业跃升计划”发布会举办

在数字浪潮下,新质生产力成核心变量。5月28日,首钢园“产业跃升计划”发布会召开。其正构建“1+3+X”产业系,园区已聚800余家科创企业。会上多位专家分享,还签约伙伴构建企业全生命周期服务系。

首钢园
新闻资讯7

大模型下半场,阶跃凭什么领跑多模态之战

国内大模型竞争分资源派、技术派、国家队三阵营,多模态成竞争分水岭。阶跃星辰成立两年发22款自研基座模型,16款为多模态。其坚持理解生成一化路线,在多模态领域有优势,还布局多应用场景。

AI科技评论
新闻资讯9

换题还是第一!DM0.5横扫RoboColiseum四榜

本文报道原力灵机DM0.5在智元机器人发起的RoboColiseum具身模型评测中拿下四个单项第一,这已是该模型连续拿下六套不同类型公开评测的榜首,攻破了传统具身模型换题掉分的痛点,目前已开源落地产业场景。

机器之心
算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做检?

随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
新闻资讯8

梁文锋突袭马斯克!DeepSeek V4 Pro对战Grok 4.6,首测夯爆了

梁文锋凌晨发布DeepSeek V4 Pro正式版,马斯克推出Grok 4.6,二者在多项评测中表现出色,直逼OpenAI和Anthropic顶尖模型,还降低了前沿智能价格。首测中,二者在真实任务场难分伯仲。

新智元
产品应用8

Claude Opus 5发布,砍掉了Claude Code 80%的系统提示词

Anthropic发布Claude Opus 5,接近Claude Fable 5智能且价格减半,测评成绩出色,科研和视觉输出能力也有进步。同时发现砍掉Claude Code 80%系统提示词,编码评测分数不变,还总结出上下文工程新方法论。

AIGC开放社区
推荐文章7

企业为什么越来越花钱买闭源模型?Decagon CEO 提出了一个很重要的新观点

Decagon CEO Jesse Zhang 提出新观点,未来 AI 会形成产业分工,闭源负责探索,开源负责规模化生产。企业市场开源模型 LLM 支出占比下降,因多数企业处探索阶段,还分析了未来 AI 行业的重要变化。

投资实习所