后训练阶段」共找到 4203 篇相关文章

8

挺意外的,Agent长期记忆潜力被AMemGym挖出来了

论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。

PaperAgent
产品应用8

美团提出全新多模态统一大模型STAR,GenEval突破0.91,破解“理解-生成”零和困局

近日美团推出多模态统一大模型 STAR,以“堆叠自回归架构 + 任务递进训练”实现理解与生成双重突破。它解决行业痛点,通过三大核心设计统一能力,实验在多任务中表现顶尖,还给出续探索方向。

机器之心
新闻资讯7

印奇的智驾困局|甲子光年

2026年初,印奇身兼千里科技与阶跃星辰董事长。千里科技转型目标是让千里智驾上车量达百万辆,但面临市场反馈不佳、财务亏损等困局。他选择整合两家公司,借助阶跃星辰突围。

甲子光年
新闻资讯7

不跟英伟达走老路,这家GPU公司的技术架构藏着哪些关键解?

在国产GPU上市黄金窗口期,天数智芯上市首场发布会引发广泛讨论。其公布架构路线图,2027年前追赶英伟达,之转向创新架构设计。还提出回归计算本质、提供高质量算力两条架构判断,并展示边端算力产品及应用。

InfoQ
新闻资讯7

元宝派、文心、UC…为什么BAT都急着给AI拉群?|甲子光年

近期,腾讯、百度、阿里等巨头纷纷推出AI群聊功能。这一产品形态源于ChatGPT测试,技术和市场因素使其受关注。AI群聊不仅是社交延伸,更能改变交互范式,或成AI时代入口,目前尚处试水阶段

甲子光年
开源动态7

刚刚,马斯克开源基于 Grok 的 X 推荐算法:Transformer 接管亿级排序

X 工程团队宣布开源 X 推荐算法,该算法结合网络内外内容,用基于 Grok 的 Transformer 模型排名。马斯克曾在 2023 年开源部分算法,此次是近三年再行动。算法开源或因平台此前分发机制受争议。

InfoQ
算法论文8

大模型听懂语音却反而变笨?港中深与微软联合解决语音大模型降智问题

从GPT - 4o开启全能交互时代,Speech LLM面临“模态推理鸿沟”问题,输入从文本变语音,推理能力显著衰退。港中深与微软联合提出TARS框架,通过三项创新解决此问题,实验显示推理能力100%复原。

机器之心
开源动态8

开源8300小时标注数据,新一代实时通用游戏AI Pixel2Play发布

随着AI在代码和图片生成领域成熟,研究人员开始关注其在游戏领域的表现。此前的专用模型缺乏跨游戏泛化能力,通用模型在游戏环境中表现不佳。为此,Player2研究员提出Pixel2Play模型,还开源了代码和数据集。

机器之心
推荐文章7

TPU vs GPU 全面技术对比:谁拥有 AI 算力最优解?

SemiAnalysis对Google TPU v7/v8深度拆解,将TPU与Nvidia GPU多方面对比拆到可计算层面。不过其结论有局限性,本文重新分析,指出TCO因场景而异,互联体系分歧在流量假设,Google TPU v8成本优势被削弱。

海外独角兽
开源动态8

SGLang Hierarchical Sparse Attention 技术深度解析

阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段

阿里云开发者