推理框架开发」共找到 4650 篇相关文章

算法论文8

ICML2025 | 揭示MLLM的图文联动推理能力

当前多模态大语言模型(MLLMs)在图文深度融合推理能力上面临挑战,现有评测基准无法真正检验该能力。EMMA基准应运而生,它从四大领域精选题目,采用双重过滤机制和细粒度标注体系,评测发现MLLMs存在多模态推理危机。

深度学习自然语言处理
新闻资讯7

谷歌发布 Firebase Studio 重大更新,用于代理式 AI 开发

7月初谷歌伦敦云峰会上,Firebase Studio展示重要新功能,包括自主代理模式、对MCP原生支持及Gemini CLI集成,旨在简化代理式AI开发,让其更自主、信息丰富且融入开发流程。

InfoQ
开源动态7

OpenAI没做到,DeepSeek搞定了!开源引爆推理革命

文章围绕大语言模型推理能力展开,介绍了推理模型概念,回顾RLHF训练流程,对比OpenAI的PPO和DeepSeek的GRPO,还阐述了GRPO开源升级版DAPO的关键技术点及训练中模型的新能力。

新智元
算法论文8

只用2700万参数,这个推理模型超越了DeepSeek和Claude

Sapient Intelligence研究者受大脑机制启发提出分层推理模型(HRM),该模型仅2700万参数、1000个训练样本,就在复杂推理任务上超越DeepSeek和Claude等模型,还引入近似梯度等创新设计。

机器之心
推荐文章7

极速开发出一个高质量 Claude Agent Skills 最佳实践

作者实践开发Claude Agent Skills积累经验分享。先介绍Skill概念,对比与MCP区别;再讲最佳开发实践,如借助AI、利用官方案例等;还给出Claude Skill自身设计、规范等方面的最佳实践及避坑指南。

阿里云开发者
算法论文8

字节跳动李航博士新作:AI智能体的通用框架

字节跳动李航博士在JCST发表观点论文,提出涵盖软件和硬件智能体的通用框架。该框架以完成任务为目标,依赖LLM,用强化学习构建。文章还探讨了与大脑机制关联、未来研究方向等。

机器之心
8

AI Infra入门干货总结:大模型是如何高效推理

作者深入研读vLLM源码,以Llama 3为例,聚焦Decoder-Only架构LLM,介绍推理各环节及张量维度变化,讲解连续批处理和Paged Attention概念,还阐述推理流程、采样策略等,最后总结相关拓展内容。

腾讯技术工程
算法论文8

Meta「透视」AI思维链:CRV推理诊断,准确率达 92%!

Meta FAIR团队在论文中提出CRV方法,可实时观察AI思维过程。它通过改造模型大脑结构,让推理可见。在算术推理实验中,检测精度提升到92.47%,还能让模型修正错误。不过该技术落地尚面临诸多挑战。

新智元
推荐文章7

【手把手教程】不写一行代码,开发鸿蒙应用,赚华为1万!

作者实测不写代码开发鸿蒙应用流程,介绍华为鸿蒙激励政策,含三档奖励最高1万。还讲搭建DevEco Studio与AI编程环境,用Claude Code开发,以及构建、打包、上架应用步骤和实用技巧。

花叔
算法论文8

拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型

大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。

PaperAgent