部署时学习」共找到 2578 篇相关文章

算法论文8

扩散模型+自进化:这篇论文让Deep Researcher错误率直降70%

论文提出测试扩散深度研究代理(TTD-DR),将报告生成建模为扩散过程,有组件自进化机制和动态闭环设计。实验显示其在多领域研究任务超现有方案,为AI研究助手落地提供新范式。

深度学习自然语言处理
新闻资讯7

微软这支神秘的华人AI团队加入腾讯混元,曝与裁员无关|独家

WizardLM项目创建者徐灿发文称团队离开微软加入腾讯混元。混元此前发布多款AI模型,WizardLM也发布过混元模型。该团队专注高级大语言模型开发,曾成绩斐然,但也面临模型部署挑战。腾讯大力投入AI,网友对此看法不一。

AI前线
算法论文7

一篇多模态大模型推理技术最新综述

华东师大&字节跳动系统回顾基于强化学习的MLLMs推理进展,涵盖关键算法设计、奖励机制创新及实际应用,探讨了RL在LLMs/MLLMs中的关键设计与优化策略,还涉及多模态大模型推理多方面内容。

PaperAgent
推荐文章7

精打细算虾养成指南: 省 Token 和把 AI 用好,从来就是一件事

文章指出用AIToken成本高、模型变笨,原因是上下文管理不善。介绍了省Token和用好AI的方法,如按需取上下文、明确约束、多智能体协作、按阶段切换模型等,核心是在合适间将合适上下文装入合适模型。

腾讯技术工程
开源动态8

刚刚,面壁小钢炮开源进阶版「Her」,9B模型居然有了「活人感」

2月4日,面壁开源全双工全模态大模型MiniCPM - o 4.5,在多方面达SOTA水平。它能边看边听边说,实现自主交互。实测中表现如真人,其架构和机制有创新,还适合端侧部署,或开启人机交互新代。

机器之心
开源动态8

9B“小”模型干了票“大”的:性能超8倍参数模型,拿下23项SOTA | 智谱开源

智谱发布并开源仅9B大小的模型GLM-4.1V-9B-Thinking,在28项评测中拿下23个SOTA,成10B级别最佳VLM模型。它引入思维链推理机制,通过课程采样强化学习提升能力,还获10亿投资。

量子位
新闻资讯7

苏姿丰出手!Oracle下单5万颗AMD芯片,英伟达王座撼动

Oracle宣布2026年第三季度起在云基础设施部署5万颗AMD Instinct™ MI450系列GPU构建AI超级集群并持续扩容。AMD Instinct MI450系列GPU亮点多,此次合作是其与Oracle合作的深化,也被视为AMD挑战英伟达的关键突破。

新智元
开源动态8

租了8张H100,他成功复现了DeepSeek的mHC,结果比官方报告更炸裂

元旦期间,DeepSeek发布的mHC震撼AI社区。FlowMode工程师Taylor Kolasinski租8张H100复现mHC,结果比官方报告更优。文章介绍复现实验,对比mHC、HC和标准残差结构,揭示超连接在规模化的不稳定性及mHC的解决办法。

机器之心
算法论文8

AAAI 2026|AP2O-Coder 让大模型拥有「错题本」,像人类一样按题型高效刷题

在AI辅助Coding技术发展背景下,开源大语言模型生成代码有运行错误。上交博士团队提出AP2O方法,构建AP2O - Coder框架,借鉴人类学习模式,经实验验证能提升模型性能、抑制错误、提高样本效率,还适配通用模型。

机器之心
新闻资讯7

独家对话 Looki 创始人孙洋:摸着自己过河

本文是对Looki创始人孙洋的独家专访。Looki L1发布后意外大火,但前期市场策略保守,未突出AI。用户使用长超预期,产品隐私设计消除担忧。团队在供货、软件迭代等方面不断探索,商业模式也在摸索中。

Founder Park