和差集」共找到 7385 篇相关文章

算法论文8

多模态后训练反常识:长思维链SFTRL的协同困境

华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。

机器之心
开源动态8

一键式训练端到端Agent,Qwen3+MCP工具高效成!

RLFactory是开源的端到端RL后训练框架,将环境与训练解耦,用Qwen3基座调用MCP工具,可低代码训练端到端Agent模型。它极致易用、训练高效,还支持一键式训练,未来会更易用高效。

深度学习自然语言处理
算法论文8

SPIRAL:零游戏自对弈成为语言模型推理训练的「免费午餐」

新加坡国立大学等机构团队提出 SPIRAL,让模型在零游戏自对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。

机器之心
新闻资讯7

全国首部AI大模型私有化部署标准,公开征起草单位个人!

近期AI领域政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但行业存在技术错配等问题。国内首部针对AI大模型私有化部署的标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征起草单位个人。

CourseAI
新闻资讯7

全国首部AI大模型私有化部署标准,公开征起草单位个人!

近期AI领域政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但面临诸多问题。由智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准立项,现征起草单位个人。

AI进修生
新闻资讯7

谷歌智能体发力:增强版Gemini Deep Research专属API都来了

OpenAI强势更新,谷歌也没闲着。正式发布增强版的Gemini Deep Research,配套推出DeepSearchQA基准测试,还发布了Interactions API,这不仅是Deep Research升级,还是Gemini生态的大升级。

量子位
新闻资讯7

全国首部AI大模型私有化部署标准,公开征起草单位个人!

近期AI政策频出,企业对AI应用需求攀升,倾向私有化部署,但行业面临技术错配等问题。国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征起草单位个人。

AI工程化
开源动态7

MIT加州联手打造多智能体大语言模型的金融交易框架TradingAgents

MIT加州联手打造多智能体大语言模型的金融交易框架TradingAgents,将交易任务分解为专业角色,含分析师、研究员等。介绍了安装、CLI使用、包的实现细节等,还提及项目地址。

GitHubStore
推荐文章7

精打细算虾养成指南: 省 Token 把 AI 用好,从来就是一件事

文章指出用AI时Token成本高、模型变笨,原因是上下文管理不善。介绍了省Token用好AI的方法,如按需取上下文、明确约束、多智能体协作、按阶段切换模型等,核心是在合适时间将合适上下文装入合适模型。

腾讯技术工程
算法论文8

10 年后,Kimi 团队重新发明残连接。马斯克 Karpathy 同时点赞

Kimi团队发布技术报告,提出用Attention Residuals替换残连接。实验显示其在各尺度模型上表现优于基线,降低训练成本。马斯克Karpathy点赞,这或标志深度学习基础范式进入重新讨论阶段。

AGI Hunt