「后训练技术」共找到 6046 篇相关文章
Yann LeCun非生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点
2026年Yann LeCun团队3篇论文展示基于JEPA框架的非生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为非生成式世界模型提供技术路线。
挺意外的,Agent长期记忆潜力被AMemGym挖出来了
论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。
美团提出全新多模态统一大模型STAR,GenEval突破0.91,破解“理解-生成”零和困局
近日美团推出多模态统一大模型 STAR,以“堆叠自回归架构 + 任务递进训练”实现理解与生成双重突破。它解决行业痛点,通过三大核心设计统一能力,实验在多任务中表现顶尖,还给出后续探索方向。
印奇的智驾困局|甲子光年
2026年初,印奇身兼千里科技与阶跃星辰董事长。千里科技转型后目标是让千里智驾上车量达百万辆,但面临市场反馈不佳、财务亏损等困局。他选择整合两家公司,借助阶跃星辰突围。
元宝派、文心、UC…为什么BAT都急着给AI拉群?|甲子光年
近期,腾讯、百度、阿里等巨头纷纷推出AI群聊功能。这一产品形态源于ChatGPT测试,技术和市场因素使其受关注。AI群聊不仅是社交延伸,更能改变交互范式,或成AI时代入口,目前尚处试水阶段。
刚刚,马斯克开源基于 Grok 的 X 推荐算法:Transformer 接管亿级排序
X 工程团队宣布开源 X 推荐算法,该算法结合网络内外内容,用基于 Grok 的 Transformer 模型排名。马斯克曾在 2023 年开源部分算法,此次是近三年后再行动。算法开源或因平台此前分发机制受争议。
大模型听懂语音却反而变笨?港中深与微软联合解决语音大模型降智问题
从GPT - 4o开启全能交互时代后,Speech LLM面临“模态推理鸿沟”问题,输入从文本变语音,推理能力显著衰退。港中深与微软联合提出TARS框架,通过三项创新解决此问题,实验显示推理能力100%复原。
开源8300小时标注数据,新一代实时通用游戏AI Pixel2Play发布
随着AI在代码和图片生成领域成熟,研究人员开始关注其在游戏领域的表现。此前的专用模型缺乏跨游戏泛化能力,通用模型在游戏环境中表现不佳。为此,Player2研究员提出Pixel2Play模型,还开源了代码和数据集。
毫无征兆!DeepSeek R1爆更86页论文,这才是真正的Open
两天前,DeepSeek悄无声息把R1论文从22页更新到86页,将其升级为开源社区可复现的技术报告。新论文干货多,如精确数据配方、基础设施说明等,且多项实力媲美甚至赶超OpenAI等闭源模型。
首家央企AI独角兽浮出水面!背靠自研大模型,4家国家队资本背书
中电信人工智能科技(北京)有限公司成为央企首家AI独角兽,完成首轮增资,引入四家国家级战略投资方。其靠自研“星辰”系列大模型,在多领域突破,实现技术与市场认可闭环,有望推动AI产业落地。