大模型个性化」共找到 9201 篇相关文章

开源动态8

告别AI胡说八道,Meta新方法CoVe准确率飙升 28%

模型‘幻觉’问题一直是‘严肃使用场景’的难题。Meta AI团队提出CoVe新方法,让模型学会‘自我反省’。该方法通过四步走实现自我纠错,能幅降低幻觉率,还具备三优势。

CourseAI
算法论文8

舍弃自回归,离散扩散语言模型如何演化?NUS综述解构技术图谱与应用前沿

本文介绍新加坡国立学xML团队的论文,梳理离散扩散方向研究图谱,对比自回归局限与离散扩散优势,阐述数理基础、模型生态、训练与推理技术,还提及应用及未来方向,显示其对自回归范式的替代潜力。

机器之心
开源动态7

DeepSeek开源新基础模型,但不是V4,而是V3.1-Base

昨晚深度求索宣布DeepSeek线上模型版本升级至V3.1,在Hugging Face发布新模型DeepSeek - V3.1 - Base。该模型是V3系列最新基础模型,发布后冲上Hugging Face热门榜第4位,社交网络看法不一。

机器之心
算法论文8

Kimi新架构让马斯克叹服!17岁高中生作者一战成名

17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B模型验证,训练效率提升25%,推理延迟增加不到2%。

量子位
新闻资讯7

35天,版本之子变路人甲:AI榜单太残酷!

LMSYS榜单揭示模型残酷现实,如Claude 3 Opus从榜首暴跌,模型“霸主保质期”仅35天,这对应用层开发者是降维打击,未来生存要么做“游击队”,要么挖掘模型无法碾压之物。

新智元
开源动态8

开源版Genie 3世界模型来了:实时+长时间交互,单卡可跑,国内公司出品

本月初 Google DeepMind 发布 Genie 3 引发关注,没过两周昆仑万维就推出开源交互世界模型 Matrix - Game 2.0,参数量 1.8B,单卡可跑,能实现实时长序列、交互式生成,经测试潜力

机器之心
推荐文章7

上下文工程的崛起:提示工程已是过去式

模型应用从简单问答转向复杂智能体系统,技术焦点正从提示工程转向上下文工程。上下文工程核心是为模型提供恰当信息与工具,其重要性日益凸显,且与提示词工程有明显区别。

AI工程化
推荐文章7

编程智能体的核心组件【译】(重发,补图)

文章围绕编程智能体展开,先厘清语言模型、推理模型与智能体关系,指出智能体是含‘模型 + 工具 + 记忆 + 环境反馈’的循环系统,后介绍编程智能体六核心组件,还对比了与 OpenClaw 的区别。

宝玉AI
算法论文8

不训练,解锁Agentic智能!微软:只需给LLM一台电脑

、MSR、清华的LLM - in - Sandbox开启「通用代理智能」新范式,把模型放进“虚拟机”,让其在6任务上成绩全线暴涨,零额外训练解锁“通用代理智能”,还介绍了相关实验、优化及效率情况。

PaperAgent
算法论文8

RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力

多模态奖励模型对提升多模态语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。

机器之心