全参数微调」共找到 2638 篇相关文章

算法论文8

这个推理模型:HRM ,只用2700万参数,超越了DeepSeek和Claude

Sapient Intelligence研究者受大脑机制启发提出分层推理模型HRM,它是新循环架构,仅2700万参数、1000个训练样本,就在复杂推理任务上表现卓越,还引入近似梯度等方法,有推动通用计算变革潜力。

AINLPer
算法论文7

最新发现!每参数3.6比特,语言模型最多能记住这么多

Meta、DeepMind等团队研究语言模型记忆容量,提出新方法估计模型对数据点的‘了解’程度,发现GPT系列模型约每个参数3.6比特,还提出模型容量等相关定律,激发社区多方面思考。

机器之心
开源动态8

开源即爆火!英伟达重磅推出OmniVinci模态大模型

英伟达在华盛顿GTC大会开源OmniVinci模态大语言模型,实现视觉、音频、语言统一理解。它性能超竞品,架构有创新,数据引擎庞大。实验有重要洞察,在多场景表现佳,代表新AI范式。

机器之心
算法论文8

「推理革命」爆发100天:DeepSeek-R1复现研究揭秘!

本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。

新智元
开源动态8

4B参数实现理解、推理、生成、编辑一体化!InternVL-U重磅开源

上海人工智能实验室联合多所高校开源多模态一体化模型 InternVL-U,仅 4B 参数,突破现有统一多模态模型瓶颈,在复杂场景超越 14B 级模型,已面开源,提供推理代码等。

OpenMMLab
产品应用8

从Vibe Coding到Agentic Engineering:重构后台开发流程

文章介绍从 Vibe Coding 到 Agentic Engineering 的转变,以真实需求为例,展示后台开发流程,涵盖需求获取到合入发布各阶段,介绍各阶段工具及操作,凸显 Agentic Engineering 优势,强调人编排、AI 执行的核心理念。

腾讯技术工程
算法论文8

微调已死?Google 和斯坦福论文指出AI 学习新范式

Google的ReasoningBank和斯坦福的ACE两篇新论文引发热议,二者都在解决让AI系统真正学会学习的问题。前者是经验管理系统,后者让输入上下文进化,都绕开微调探索AI持续学习与自我改进能力。

AI工程化
算法论文8

谷歌助力神经科学飞跃,破解斑马鱼脑活动密码

谷歌等机构科学家联合发布开创性研究成果ZAPBench,这是预测斑马鱼脑活动的基准测试平台。它含超70000个神经元4D光片显微镜记录,设计多种刺激条件采集数据,有特定基准测试任务和评估指标。

AIGC开放社区
开源动态7

网首份「龙虾」安部署指南来了!360出品

近日,开源AI智能体OpenClaw走红,多地出台扶持政策,部署成趋势。但它带来新安挑战,工信部、信通院等已预警。360集团率先发布国内首份《OpenClaw安部署与实践指南》,为政企和开发者提供安参考。

量子位
新闻资讯8

OpenAI总裁底牌交了:买下地球上所有的算力

OpenAI总裁Greg Brockman接受访谈,核心观点是世界长期缺算力。他指出算力需求远未释放,H100涨价凸显供应紧张,OpenAI要买光算力、自研芯片,还谈到价格与利润、产品形态、智能体应用及医疗领域潜力等。

AI寒武纪