两阶段训练法」共找到 3112 篇相关文章

新闻资讯7

「2025 AI 实战手册」,年收入破亿的 AI 公司都在干什么?

硅谷 ICONIQ Capital 团队发布 2025 年度「The State of AI」报告,围绕 AI 产品落地,通过问卷收集 300 家 AI 公司高管回答,从开发、定价等五方面剖析 AI 产品端到端流程,还对比了 AI 原生和赋能型公司产品发展。

机器之心
算法论文8

这个推理模型:HRM ,只用2700万参数,超越了DeepSeek和Claude

Sapient Intelligence研究者受大脑机制启发提出分层推理模型HRM,它是全新循环架构,仅2700万参数、1000个训练样本,就在复杂推理任务上表现卓越,还引入近似梯度等方法,有推动通用计算变革潜力。

AINLPer
新闻资讯7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播邀请华为、蚂蚁集团等专家探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代冲突处理、推理部署成本优化、开源项目挑战及 GPU 虚拟化趋势等内容。

AI前线
算法论文8

更多thinking≠更好结果,精准thinking可砍掉一半长度

当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。

深度学习自然语言处理
开源动态7

多模态需求井喷,智能视频云如何靠分布式处理破局?

国内多模态AI发展中,模型层火热但应用层落地慢。多模态应用落地面临体验升级、视频化扩展、大模型部署下沉挑战,催生智能视频云升级需求。火山引擎在FORCE大会展示分布式多媒体处理实践,推出MIPP平台,未来将开源并推商业化产品。

InfoQ
新闻资讯7

o3-pro通关“推箱子”,人类怀旧小游戏成了大模型新Benchmark

推箱子、俄罗斯方块等经典小游戏成大模型benchmark,o3 - pro挑战这款游戏表现出色,突破benchmark上限,成绩远超o3。Lmgame含多款游戏,有不同评价方式,且开源可用于模型测试。

量子位
开源动态7

从browser-use 出发,品 Agent 实现

本文作者以学习总结视角,从browser - use出发解析Agent实现。介绍LLM不同阶段,阐述Agent记忆、规划、工具等要素,通过对话演示和源码分析展示运行机制,还探讨MCP集成和Coze space应用模式。

阿里云开发者
算法论文8

Meta联合Google新作:语言模型到底“记”了多少东西?

Meta和Google合作的论文探讨现代语言模型对训练数据的“记忆”情况。研究发明新方法精确测量“记忆”量,发现模型记忆有上限且与参数线性相关,还揭示学习转折、隐私规律等重要结论。

深度学习自然语言处理
算法论文8

南开 && UIUC | SearchAgent-X,打破「效率瓶颈」,让复杂「AI搜索智能体」走向现实

南开大学和伊利诺伊大学厄巴纳 - 香槟分校的研究提出SearchAgent - X框架,解决大型语言模型驱动的搜索智能体效率痛点。它剖析制约效率的原因,通过大‘加速引擎’优化性能,实验显示效果显著。

AINLPer
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心