工业场景」共找到 2040 篇相关文章

算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。

量子位
开源动态8

Qwen-Scope:看穿大模型的“小心思”

Qwen-Scope是基于Qwen3和Qwen3.5系列模型训练的可解释性模块,通过在隐藏层插入SAE提取可解释特征。它能分析模型行为、优化模型,应用于推理、数据、训练、评估等场景,可前往Huggingface或魔搭体验。

千问大模型
产品应用7

谷歌向左、李飞飞往右,阿里世界模型「快乐生蚝」杀出第三条路

阿里推出世界模型HappyOyster(快乐生蚝),基于原生多模态架构,有漫游和导演两大核心功能,可实时构建和交互。与文生视频模型不同,它能随时被干预。虽世界模型尚处早期,但应用场景广泛。

机器之心
推荐文章7

AI 时代,产品经理的“翻译层”正在消失

随着AI能力进化,产品经理在用户和工程师间的‘翻译层’正坍塌。工作效率从周变小时,模式从写规格书变为用Agent做原型。PM需掌握定义问题等新技能,转变思维,虽部分场景适用,但有组织阻力。

宝玉AI
新闻资讯7

SpAItial发布超逼真3D空间基础模型

德国AI初创平台SpAItial获1300万美元种子轮融资,发布超逼真3D基础模型。其核心技术能理解3D世界,可基于文本或图片生成3D场景,在多领域有革新可能,虽有竞争,但未来有望推动AI三维突破。

AIGC开放社区
新闻资讯7

用DeepSeek网页版就能瓜分鹅厂600万??!

腾讯营销以KDD Cup 2026官方赛道身份出题,聚焦推荐系统统一建模,奖金600万+。全球众多选手参与,学术和工业赛道各有冠军方案,还设创新奖。赛事也推动了鹅厂人才培养体系的拓展。

量子位
新闻资讯8

DeepSeek Harness 入选项目疑似曝光,不选万星「花瓶」,死磕 Agent 基建

昨晚 DeepSeek V4 Pro 发布,欲迈向“工业级 Agent 生产线”。网上爆出 DeepSeek Harness 内测入选项目名单,筛选重实用功能,多集中在 MCP 插件、Coding Agent 等赛道,还介绍了部分入选项目及战略意图。

AI科技评论
推荐文章7

什么时候不该微调:比“怎么微调”更重要的一件事

文章指出微调失败常因一开始就不该调。强调微调解决行为问题而非能力问题,还列举了不该微调的五种场景,如知识接入问题、Prompt没写好等,建议先验证思路,明确目标再行动。

机器学习AI算法工程
推荐文章8

超实用提示词模板!AI科学家教你用协作提示词激发大模型潜力

文章由知名AI科学家Lance Eliot所写,指出主流大语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景

AIGC开放社区
新闻资讯7

MCP 或将成弃子

Anthropic工程师发博客‘背刺’自家MCP,提出新方案让token消耗大减。新方案把MCP服务器转成代码文件运行,Skills或成MCP替代品,虽MCP还有价值场景,但多数情况下代码+Skills更优。

AGI Hunt