多阶段训练」共找到 5963 篇相关文章

推荐文章7

Clawdbot 之后,我们离能规模化落地的 Agent 还差什么?

OpenClaw爆火,但在企业和商业环境中存在昂贵、不可控等问题。Monolith砺思资本技术沙龙探讨Agent规模化落地难题,指出需关注稳定性等指标,还分析了数据成本、训练速度、基础设施、状态管理等方面的困境与解决思路。

Founder Park
新闻资讯8

从“能用”到“敢用”:企业级 AI 落地的终极答案 | AICon 2025 收官

12月19 - 20日AICon 2025大会落幕,众企业专家参与,探讨企业级AI落地。InfoQ王一鹏谈AI落地趋势与流畅度构建;大会发布「2025中国技术力量年度榜单」,位嘉宾演讲分享AI见解,还有17个分论坛和合作展区。

InfoQ
开源动态8

社区供稿 | 阿里国际Ovis2.5重磅发布:以小博大,刷新开源模型性能新高度

阿里国际发布模态大模型Ovis2.5,在OpenCompass综合得分提升,保持SOTA水平。它在原生分辨率视觉感知等三方面突破,有9B和2B两版本,代码、模型等资源已开源,技术原理涉及架构、训练与数据。

Hugging Face
开源动态8

华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在基准创 7B 参数量级 SOTA,还解析了其技术革新。

机器之心
算法论文8

从少样本到千样本!MachineLearningLM给大模型上下文学习装上「机器学习引擎」

新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力大,还指明未来研究方向。

机器之心
新闻资讯7

OpenAI算力账单曝光:70亿美元支出,大部分钱花在了“看不见的实验”

据Epoch AI统计,去年OpenAI计算资源支出70亿美元,以租微软云算力支付。其中50亿研发算力,大用于幕后研究和实验,非爆款模型的最终训练,也解释了其2024年亏损原因。

量子位
推荐文章7

企业为什么越来越花钱买闭源模型?Decagon CEO 提出了一个很重要的新观点

Decagon CEO Jesse Zhang 提出新观点,未来 AI 会形成产业分工,闭源负责探索,开源负责规模化生产。企业市场开源模型 LLM 支出占比下降,因数企业处探索阶段,还分析了未来 AI 行业的重要变化。

投资实习所
开源动态8

HAMi × NVIDIA:GPU 拓扑感知调度实现详解

HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。

AI前线
开源动态7

OpenAI解密大模型失控:它不是变坏,而是「太听话」

OpenAI公开IH - Challenge,解决大模型指令冲突难题。指出大模型问题因听信错误指令,给出系统>开发者>用户>工具的指令层级结构,设计数据集训练模型遵循高信任等级指令,提升安全可控性与抵御提示词注入能力。

新智元
推荐文章7

当前关于 Vibe Engineering 的所有认知都会在 1 个月内严重过时

作者分享 Vibe Engineering 实践体会,指出当前认知很快过时,因 AI 编程工具和模型进步大。还对比了 Opus 4.5、GPT - 5.2 等模型,阐述人在开发各阶段角色,介绍 Agent 协同实践及未来软件公司组织形态变化。

InfoQ