体验式学习」共找到 2562 篇相关文章

新闻资讯7

昨日,AI内容新规正实施,这次不注意是真的会违法。

9月1日,《人工智能生成合成内容标识办法》及配套国标正执行。新规规定AI模型或应用提供方要给生成内容打“显”与“隐”标识,对产品创业者、AI工具提供方和创作者等提出不同要求。

开源星探
新闻资讯7

今天,AI内容新规正实施,这次不注意是真的会违法。

9月1日,《人工智能生成合成内容标识办法》及配套国标正执行。其旨在解决AI虚假内容充斥问题,规定AI内容需打显和隐标识,对专业环节友好、公开传播严厉,还对相关方提出不同要求。

数字生命卡兹克
算法论文8

DeepSeek-GRPO重要性权重设计错误?详解Qwen3新强化学习算法GSPO

论文指出GRPO在大语言模型训练中不稳定,因其重要性权重设计错误易引入高方差噪声。为此提出GSPO算法,从序列维度计算梯度,解决了MoE模型RL训练的稳定性问题,在Qwen3上效率更高。

深度学习自然语言处理
产品应用7

Gemini CLI 重磅更新:现已支持音视频处理,并带来多项体验升级

Gemini CLI 迎来重磅更新,带来多项改进。新增音视频输入(暂未正开启)、增强 Markdown 功能,集成 VSCodium 和 Neovim,技术栈升级至 Ink 6 和 React 19,还有主题更新、隐私管理等优化。

AI寒武纪
新闻资讯7

谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。

Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止有害行为。

探索AGI
推荐文章7

不是视频模型“学习”慢,而是LLM走捷径|18万引大牛Sergey Levine

UC伯克利大学副教授Sergey Levine提出,为何语言模型从预测下一词中学到很多,视频模型从预测下一帧却学得少。他指出LLM可“抄近路”模仿人类推理,像在“柏拉图洞穴”中,还探讨了AI走出困境的方法。

量子位
推荐文章8

推荐系统进入“大模型时刻”:昇腾NPU如何支撑千亿级生成推荐落地

文章基于华为郭威在2025 AICon大会演讲,复盘华为推荐技术探索。介绍FuXi-α、β模型设计,解决训练和推理难题;分享“多阶段统一建模”进展,提出Performance Law;还介绍了训推系统优化及未来聚焦“强算力”“强模型”融合。

InfoQ
新闻资讯7

全球电池回收技术爆发:中国专利断层领先,宁德时代子公司排第一

欧洲专利局和国际能源署报告显示,全球电池回收技术创新爆发,循环利用专利增长快。中国在该领域表现突出,宁德时代子公司邦普循环专利领先,且中国掌控矿产精炼与回收两端,不过全球面临缺料挑战。

DeepTech深科技
算法论文8

你写的Skill,正在拖慢模型?策略Gene才是正确答案

EvoMap团队与清华围绕‘Skill拖慢模型’问题研究,提出‘Gene’概念。经实验,Gene在控制模型表现上优于Skill,还定义了GEP协议。其成果在CritPt基准测试表现出色,为Agent经验复用提供新方向。

机器之心
推荐文章8

Agentic UI:重新定义“好体验”——不是美化按钮,而是让认知负担归零

随着 AI 从“辅助者”变为“执行者”,前端架构需重新定义。传统 UI 以“人是执行主体”为假设,已成为释放 Agent 执行能力的障碍。文章提出 Agentic UI 应成为数字员工的执行工作台,介绍了构建方法及试验成果。

phodal