学习提升」共找到 3907 篇相关文章

算法论文7

一文解读 LLM Posting-Train技术

文章解读了大语言模型后训练(Post-training)技术,介绍其核心价值,从微调、强化学习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。

海边的拾遗者
算法论文8

金属探伤微小缺陷:YOLOv11 改进,漏检率从 54% 降低到 19%

工厂质检工作累且易出错,用摄像头加AI检测,需模型在复杂车间环境识别微小缺陷。论文对YOLOv11改进,插入三个即插即用模块,降低漏检率、提升精度,还做了公平实验,公开数据。

机器学习AI算法工程
新闻资讯8

DeepMind 创始人 Hassabis 语出惊人:百万 token 只是在贴胶带,AGI 在 2030 年

DeepMind创始人Hassabis在访谈中评估AGI进展,认为当前范式是最终架构一部分,但持续学习等问题待解决,预计2030年左右实现AGI,还探讨了Agent、蒸馏等多方面内容,并给创业者建议。

MacTalk
算法论文7

做RAG这一年,最后悔的就是上知识图谱

基于知识图谱的检索增强生成在问答任务中存在三元组索引丢失上下文语义问题,作者提出MDER - DR双阶段框架,在标准测试和特定数据集上性能提升最高66%,还具备多方面优势。

PaperAgent
算法论文8

港大赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026

扩散模型虽能生成逼真图像,但存在“奖励作弊”问题。港大赵恒爽团队提出 GDRO 后训练方法,引入组级奖励优化机制,提升模型表现、缓解作弊,还提高训练效率,有明显工程价值。

AI科技评论
新闻资讯8

Anthropic首份内部报告出炉!自家工程师亲述:生产力飙升50%,但感觉在亲手砸掉自己饭碗

2025年8月,AI巨头Anthropic对内部员工调查,揭示AI真实影响。员工使用Claude比例和生产力提升,还催生新工作。但大家对委托工作比例低,且在技能、社交和职业发展上有不同感受。

AI寒武纪
算法论文8

DeepMind再登Nature:AI Agent造出了最强RL算法!

Google DeepMind团队提出DiscoRL,让智能体在多环境交互中自主发现强化学习规则,无需人类设计。它在Atari基准中击败MuZero,在未见过的游戏中也稳定高效,相关研究登《Nature》。

新智元
产品应用7

让YOLO飞起来:从CPU到GPU的配置指南

文章指出默认安装的YOLO用CPU计算,处理大量图像或实时检测任务效率低。详细介绍将YOLO从CPU模式切换到GPU模式的步骤,对比性能,还给出常见问题解决办法,能显著提升运行效率。

机器学习AI算法工程
新闻资讯7

AI 写 80%,人修最后 20%:这是什么新赛道?“ AI 代码补锅匠 ”了解一下。

Vibe Coding 成 2025 年 AI 驱动开发核心趋势,强调用自然语言提示让 AI 生成代码。虽可提升效率,但 AI 生成代码有质量、安全等问题,催生付费修复服务,未来“AI+专家”模式或成主流。

AI进修生
算法论文8

推理路径的动态调控:让大模型学会“恰到好处”的思考

当前大模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理