策略改进」共找到 1265 篇相关文章

开源动态8

1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人

微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。

量子位
新闻资讯7

Ilya震撼发声!OpenAI前主管亲证:AGI已觉醒,人类还在装睡

OpenAI前主管、Anthropic联创Jack Clark称AI已「活」,人类却装作没看见。他既对AI技术进步乐观,也有深切恐惧,还指出AI虽未达自我改进阶段,但未来有独立思考设计自我的可能。

新智元
算法论文8

如何改变AI研究范式?谷歌DeepResearch新方法TTD-DR原理与实现 | 原理篇

谷歌提出新的DeepResearch方法TTD - DR,它模拟人类研究范式,将Agent起草的初稿视为‘含噪声输出’,经多轮检索 - 改进使初稿成高质量终稿,还引入自进化机制,测试显示其在复杂任务上领先。

AI大模型应用实践
新闻资讯8

Anthropic 发布 AI Agent 上下文工程指南

今年6月Andrej Karpathy提出用「上下文工程」取代「提示词工程」。Anthropic发布工程博客呼应此观点,指出构建AI应用重心转向策划上下文。文章详述上下文工程重要性、有效上下文剖析、检索及长时任务应对技术等。

AGI Hunt
算法论文8

复旦、同济和港中文等重磅发布:强化学习在大语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三大贡献。

机器之心
算法论文7

ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍

文章介绍HyperGraphRAG模型,它由知识超图构建、超图检索策略、超图引导的生成机制三部分组成。构建含知识超图构建、超图检索、生成机制等步骤,能提升检索效率与答案质量,或成ACL 2025爆款。

PaperAgent
产品应用7

Ollama升级模型调度系统:内存管理更精准,多GPU性能提升

Ollama升级模型调度系统,精确测量运行模型所需内存,带来内存崩溃减少、GPU利用率提高等改进。Gemma3、Mistral - small3.2等模型性能提升,更多模型正迁移,还在开发iGPU支持,评估NPU支持。

AI工程化
新闻资讯7

Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认不达标为何不退钱?

8 - 9 月初Claude模型质量下降,Anthropic发文解释是因三项基础设施漏洞。介绍了三个bug及处理办法,也分析检测难的原因并给出改进方案,但很多用户已不再买账,Claude用户流失问题持续。

AI前线
算法论文8

具身VLA后训练:TeleAI提出潜空间引导的VLA跨本体泛化方法

现有VLA基座模型能力不足,跨本体适配存在挑战。中国电信人工智能研究院具身智能团队提出“对齐 - 引导 - 泛化”(ATE)框架,实现从调架构到调分布的范式转移,适配主流VLA模型,减少数据需求。

机器之心
新闻资讯7

专访 RockFlow Vakee:AI 如何重构投资体验,让金融“说人话”

该专访对话 RockFlow 创始人 Vakee,探讨 AI 重构投资体验。她分享创业初衷、团队理念及人才需求,还谈及 GenZ 投资特点与 RockFlow 应对策略,介绍了 Bobby 功能、规划及 RockFlow 在金融科技领域的发展方向。

特工宇宙