效果提升」共找到 3504 篇相关文章

算法论文7

告别Reasoning模型的“灵光一现”,推理能力可控了

当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。

深度学习自然语言处理
开源动态7

MiniMax开源技能包:让AI写代码从大学生变资深工程师

MiniMax 官方开源 skills 仓库,能提升 AI 写代码质量,从‘大学生水平’升为‘5年+资深工程师’。其覆盖多种开发场景,支持四种主流 AI 编程工具,配置后重启可用,具体效果因场景而异。

AI工程化
算法论文8

省下1.25倍算力!Kimi这篇论文,可能改写所有大模型的训练方式

大模型层数增多时,残差连接存在PreNorm稀释问题,导致后面层贡献被稀释。Kimi论文提出Attention Residuals方案,还给出工程解法Block AttnRes,实验显示能省算力且提升效果

AI寒武纪
产品应用8

30 小时不眠不休写代码,Claude 4.5 的三个“最佳”

Anthropic发布Claude Sonnet 4.5,宣称其为“世界上最好的编码模型”等。它在测试中表现出色,能力全面提升,价格实惠,开发者测试效果佳。还注重安全,升级开发工具和生态系统。

AIGC开放社区
产品应用8

巧妙!一个传统技术让国产视觉基础模型直接上大分

格灵深瞳的Glint - MVT视觉基础模型表现出色,线性探测准确率高于CLIP等,下游任务效果佳。其引入间隔Softmax损失函数,结合虚拟类别构造等优化方案提升性能,团队专注视觉研发,务实开放。

量子位
算法论文8

75%预训练数据都能删!Jeff Dean新作:全自动筛除低质量数据

Google DeepMind团队开发的DataRater可全自动评估数据质量,用元学习筛选有价值数据,提升模型训练效率。它能减少计算量、提高性能,在低质量数据集效果佳,还能跨模型规模泛化。

新智元
新闻资讯7

LLM抢人血案:强化学习天才被挖空,一朝沦为「无人区」!

斯坦福AI+CS博士Joseph Suarez回顾强化学习历史,指出其曾因学术短视、学界追名逐利走向衰落。如今他坚持用小模型从零开始的RL,重建标准,让研究速度和效果大幅提升

新智元
算法论文8

强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升

人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。

量子位
推荐文章7

详细介绍!RAG 和 GraphRAG:了解何时(When)、如何(How)使用它们

文章详细介绍传统RAG和GraphRAG技术,前者通过向量搜索检索上下文,但无法体现数据关系;后者用知识图谱提升检索效果,亮点是构建图谱、整合信息。还指出两者优缺点,建议结合使用。

AINLPer
产品应用7

突破视频时长限制!Manus上架视频生成功能,网友:比Sora更好

Manus上架视频生成功能,可通过连续拼接突破时长限制。它按“拍电影”方式,根据提示词生成片段再合成故事。网友评价是新创作方式,但效果提升空间,部分人认为比Sora好。

量子位