「两阶段训练法」共找到 3110 篇相关文章
普通程序员怎样转到AI方向拿到更好的offer
在AI研究员拿天价offer的当下,探讨普通程序员转AI方向拿更好offer的方法,还介绍了AI生态的五个层次,包括各层岗位、年薪及容量。
突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度
在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。
Agent 成大厂新“战场”?从同程旅行 DeepTrip 看垂类 Agent 的设计与落地实践
文章聚焦同程旅行推出的垂类旅行 Agent DeepTrip,介绍其设计与落地实践。它能降低旅行决策成本,构建旅行服务生态。团队基于多方面考量选 Agent 架构,还从多维度介绍实现方法及未来规划。
MiniMax重磅开源M1模型:百万上下文超DeepSeek R1,实现性能与效率双杀
MiniMax正式开源首个推理模型M1,原生支持百万级上下文长度,在推理效率、计算成本和复杂任务能力上有独特表现。其在性能和效率上超越DeepSeek R1等模型,还提出创新强化学习算法。
卷疯了!2.2k Star通用型、开源Agent平替Manus、GenSpark AI
2025 年是 Agent 之年,文中介绍了 Manus、GenSpark AI 两款闭源代理,还重点阐述开源的 II - Agent,它功能丰富,架构设计合理,在 GAIA 基准测试评估,性能可平替前两者。
复旦提出自适应Reasoning方法ARM,“能屈能伸”
复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。
目标出货一亿台,Altman和Ive的新公司「io」到底要做什么硬件?
本周三,OpenAI收购AI硬件创企「io」,引发对合作细节和硬件产品的猜测。Sam Altman和Jony Ive计划打造非手机、眼镜的设备,成第三核心小工具,计划出货1亿台,目标明年年底推出。
AI版Office全网首测,键盘鼠标彻底退休!打工人沸腾
昆仑万维天工超级智能体(Skywork Super Agents)结合Deep Research和通用Agent优点,带来AI版office。它有超能Office「六件套」,六大卖点亮点足,具五大自研硬核实力,填补市场空白,有望成智能体赛道黑马。
刚刚,中国语音AI连拿多项全球第一!
本文报道阶跃星辰推出StepAudio 3全系列五款音频大模型,覆盖听、说、理解、交互、创作全语音链路,拿下三项第三方评测全球第一,分析了语音AI行业从单点竞赛转向全栈体系竞争的新趋势。
想给产品加一个 AI 搜索,是上向量数据库还是用 MongoDB 就够了?
本文解答产品添加AI搜索时,选用专用向量数据库还是MongoDB的选型疑问,理清两类检索的能力边界,讲解MongoDB检索的架构、用法与踩坑点,给出可复用的选型判断框架。