「推理流程」共找到 2773 篇相关文章
DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5
DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。
逆天改命!OpenAI 开源模型的安全底裤被 Meta 研究员给扒掉了……
Cornell大学兼Meta研究员jack morris成功将OpenAI最新开源的推理专用模型GPT-OSS逆向还原成基础模型,绕过对齐和安全措施,还暴露其训练用大量版权材料问题,此成果引发社区激烈讨论。
字节开源终身记忆多模态智能体,长时记忆+RL,实测超Gemini‑GPT4o!
字节开源全球首个带终身记忆更新的全多模态智能体M3 - Agent,给其装上‘长期记忆’大脑。它构建实体记忆图谱解决现有Agent问题,架构含两个流程,代码实现有特色,跑分数据出色。
微软发布5大AI Agent模式:一键解锁AI员工,打造智能体工厂
今天凌晨微软官网发布5种常用Agent模式助用户开发自动化AI员工。智能体比传统自动化工具更具优势,能推理协作等。各模式都有应用案例,且Azure AI Foundry支持多Agent模式开发。
理解、生成、编辑一次搞定:Skywork UniPic 2.0的统一多模态解法|甲子光年
电商团队常面临创作流程繁琐问题,当前行业需统一架构。昆仑万维发布Skywork UniPic 2.0,整合理解、生成、编辑功能。它参数小性能优,还构建奖励模型,配合其他模型构建体系,具成本等优势。
LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考
随着推理大模型和思维链普及,大模型有了‘深度思考’能力,但现在有些偏科,简单任务也复杂化。AI大牛Andrej Karpathy发长文指出该现象,认为是基准测试优化所致,大模型发展不能只追求分数。
阿里、南开大学发布免训练,视频大模型创新压缩方法
视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。
半量工具,双倍效能:ARPO革新大模型强化学习
大语言模型在多轮工具调用场景有挑战,传统强化学习算法有探索效率低和资源消耗大问题。本文提出ARPO,通过量化token熵分布变化设计自适应探索机制,降低工具调用成本且提升多轮推理性能。
全国首部AI大模型私有化部署标准,公开征集起草单位和个人!
由中国电子商会归口,智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准立项,正征集起草单位和个人。该标准可解决企业部署难题,由多元主体联合起草,参与有重要价值。
The Batch: 849 | 用于训练网页智能体的生成数据
开发网页智能体常需大量人力标注训练样本,卡内基梅隆大学与亚马逊团队实现训练数据生成自动化。他们构建数据集,通过智能体工作流程生成数据,微调后 Qwen3 - 1.7B 表现出色,还公开数据与方法。