后训练技术」共找到 5930 篇相关文章

开源动态8

多模态Qwen3-VL-Embedding开源&技术剖析

互联网内容多元,传统文本搜索引擎应对跨模态需求力不从心。阿里开源Qwen3-VL系列两大模型,Qwen3-VL-Embedding负责“海选”,Qwen3-VL-Reranker负责“决赛”,技术亮点多,实验表现优异。

PaperAgent
产品应用8

阿里WebDancer:训练类DeepReaserch的Agentic Model

来自阿里巴巴通义实验室的研究员推出WebDancer,这是一个原生信息检索的Agentic Model,能自主浏览网页、思考和决策。它基于ReAct框架,经多阶段训练,在信息检索基准测试中表现出色,为解决复杂检索问题提供新思路。

PaperAgent
新闻资讯7

90哈工大学霸,要IPO了

近日,90 哈工大学霸王永锟创立的斯坦德机器人向港交所递交上市申请,冲刺'工业具身智能第一股'。该公司成立 9 年估值达 21 亿,发展历经波折,如今业务向好,但研发投入变化引关注。

芯师爷
新闻资讯7

稚晖君最新188机器人,阅即焚

具身智能机器人正火,上纬新材原本做复合材料,被稚晖君联合创办的智元机器人拿下控股权。智元上纬发布两张机器人图,上纬新材股价涨停,文章被删。目前其机器人业务未量产、无营收,收购过程历时四个月完成。

量子位
新闻资讯8

硅谷今日最热具身模型!不用训练,看一遍就学会

北美具身初创Skild AI发布全新机器人基础模型S1,主打上下文学习,能看示范视频完成复杂操作。在未见过任务上成功率达66%,远高于传统方法。其发展或让开发机器人技能像给ChatGPT写Prompt。

量子位
算法论文8

多模态训练反常识:长思维链SFT和RL的协同困境

华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。

机器之心
推荐文章7

AI时代:判断力为何比技术能力更重要?

音乐家布莱恩·伊诺1995年指出计算机音序器把技术问题转为判断问题,如今AI时代这一洞察更凸显价值。技术壁垒消失,判断力成关键差异,未来职业将向战略判断转变。

宝玉AI
推荐文章7

所谓“氛围编程”,不过是“技术债”的新马甲

本文编译自 Steve Krouse 演讲与博客,指出‘氛围编程’代码即遗留代码、‘技术债’,编程核心是理论构建。还认为工具优于智能体,代码是描述软件的正确媒介,人类大脑在编程中始终是核心。

AI科技大本营
推荐文章7

技术更新 or 组织重塑,企业如何用好“数据智能”?

InfoQ《极客有约》X AICon 直播栏目邀专家探讨企业数据智能应用。谈及构建数据集、优化检索效率等问题,还分析数据准备挑战、DeepResearch 优势,指出数据智能落地面临组织与技术层面的挑战。

InfoQ
新闻资讯8

AI转型最大的门槛,不是技术,是人

浪潮信息董事长彭震在人工智能+生态大会上提出,AI转型最大门槛是人而非技术。他指出组织力不足影响业务效果,提出Humagent概念。浪潮信息还从文化、组织、流程层面推动转型,愿做客户同行者。

量子位