后训练技术」共找到 5938 篇相关文章

开源动态8

微软开源3大突破AI Agent模型,仅140亿参数超越DeepSeek-R1

微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数在多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,在训练基础、算法、流程上有三大突破,显著提升性能且降低算力成本。

AIGC开放社区
开源动态8

媲美DeepSeek!腾讯开源新版混元模型:AI Agent强化,超30种智能体指令

腾讯开源混元大模型最新版本Hunyuan - A13B,为专家混合模型,有800亿参数,130亿激活。支持快慢思考模式,针对AI Agent强化,设计超30种智能体指令。测试成绩超DeepSeek - R1等,架构和训练有优化。

AIGC开放社区
算法论文8

Meta提出StepWiser,让模型学会“反思”自己的推理过程

Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成式评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。

深度学习自然语言处理
开源动态8

马斯克掀桌子了,最强开源大模型诞生!Grok-2近万亿参数性能首曝

xAI官宣向所有人开源Grok - 2,其有9050亿参数、128k上下文窗口等强大技术规格。还梳理了开源部分、技术特点、权限等,介绍使用方法,网友和大佬高度评价,马斯克预告续计划。

新智元
算法论文8

微调已死?Agentic上下文工程登场,无需微调实现模型进化

斯坦福大学等团队提出 Agentic Context Engineering 技术,让语言模型无需微调自我提升。它将上下文视为作战手册,引入三种协作角色与三项创新,实验显示其在两类任务上表现优异,成本和延迟显著下降。

机器之心
算法论文8

LeCun出手,造出视频世界模型,挑战英伟达COSMOS

训练有效世界模型面临数据、任务难度、算力消耗和评估等难题。Meta研究者提出通用视频世界模型DINO - world,可预测未来帧,在多方面有优势,实验显示其性能显著,能降低对标注数据需求。

机器之心
新闻资讯8

这些关于研发提效的深度实践,值得每一位开发者关注 | AICon

6月27 - 28日AICon北京站上,一线大厂技术大牛将分享“AI赋能研发提效”经验,涉及AI编程范式革新、代码智能化落地、研发流程优化等多方面,呈现技术演进与落地路径。

InfoQ
新闻资讯7

HF Papers直播 AI Insight Talk | OCR 专场

由Hugging Face等联合发起的【AI Insight Talk】系列直播活动第6场 - OCR专场明天开启。将剖析三项技术方案,举办圆桌对谈。还会有嘉宾介绍HunyuanOCR、PaddleOCR - VL、MinerU等模型的技术亮点。

Hugging Face
算法论文8

华为中科大联创大模型低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科大提出CBQ训练量化方案,仅用0.1%训练数据实现大模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
新闻资讯7

All in AI 两年,AI 代码采纳率突破 50%!安克创新龚银:AI 平台一旦过时,我们会毫不犹豫重构

安克创新2023年决定All in AI,探索适配内部运营与新的产品形态。这两年有项目放弃也有成果,如代码采纳率突破50%。其评估AI落地可行性关注业务、技术、团队成熟度,还采取差异化管理应对创新的ROI问题。

InfoQ