学习方式」共找到 2103 篇相关文章

新闻资讯8

DeepMind 创始人 Hassabis 语出惊人:百万 token 只是在贴胶带,AGI 在 2030 年

DeepMind创始人Hassabis在访谈中评估AGI进展,认为当前范式是最终架构一部分,但持续学习等问题待解决,预计2030年左右实现AGI,还探讨了Agent、蒸馏等多方面内容,并给创业者建议。

MacTalk
新闻资讯7

AI 正在毁掉开源:从“协作圣地”到“垃圾洪水”,维护者士气跌至谷底,开始集体掀桌

AI Slop正破坏开源开发中维护者与贡献者的社会契约,贡献数量使系统不堪重负。文章探讨AI Slop时代开源现状、维护者应对方式,还提及基金会政策、极端选项、激励问题,并给出最终建议。

InfoQ
算法论文8

DeepMind再登Nature:AI Agent造出了最强RL算法!

Google DeepMind团队提出DiscoRL,让智能体在多环境交互中自主发现强化学习规则,无需人类设计。它在Atari基准中击败MuZero,在未见过的游戏中也稳定高效,相关研究登《Nature》。

新智元
推荐文章7

MCP高手进阶【一】:彻底弄懂生命周期管理器(Lifespan)的机制与用法

文章深入解读MCP SDK开发高级技巧,聚焦生命周期管理器(Lifespan)机制与用法。先介绍Python上下文管理器,再讲FastAPI的lifespan,接着说明MCP Server的使用流程,最后分析不同传输模式下的工作方式

AI大模型应用实践
算法论文8

MIT发布自适应语言模型!新任务,自生成远超「GPT-4.1合成训练数据」

麻省理工学院提出自适应语言模型框架SEAL,让大模型生成微调数据和更新指令适应新任务。实验显示,其生成的合成数据微调效果超GPT - 4.1,在少样本学习和知识整合任务表现优异。

新智元
开源动态7

LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析

文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式

GiantPandaLLM
算法论文8

调整训练数据出场顺序,大模型就能变聪明!无需扩大模型/数据规模

微软亚洲研究院提出全新文本数据组织范式DELT,通过引入数据排序策略,充分挖掘训练数据潜力,优化训练数据的组织方式,在不同模型尺寸与规模下都达到了良好性能,且不用增加数据量或扩大模型规模。

量子位
推荐文章8

深度对话 Benchmark 合伙人:AI 打破了 SaaS 的 3322 规则改变创造本质

Benchmark 合伙人 Eric Vishria 与 Banana Capital 合伙人 Turner Novak 对话,分享 AI 时代创业看法、投资策略等。他认为 AI 打破 SaaS 增长法则,关注创始人叙事、学习能力,坚持投资非凡公司,还谈了对上市、估值等的观点。

投资实习所
产品应用7

支持中文!NotebookLM自动生成播客

Google宣布NotebookLM语言摘要功能支持50多种语言,包括中文,可将上传文档转成播客对话形式。以一篇AI进化论文为例展示效果,其音频和内容质量不错,学习输入立体,还能助力AI播客创作。

newtype AI
开源动态7

Anthropic开源Claude小企业插件:不用写prompt,15套现成流程顶半个运营团队

Anthropic开源面向小企业的Claude插件,有15个基础技能、15套业务工作流及懂大白话的路由模块。支持Claude Cowork和Claude Code,操作待确认。日常使用几乎无学习成本,安装配置较简单,亮点是降低交互门槛。

AI工程化