端到端微调」共找到 2546 篇相关文章

开源动态8

通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API

阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。

量子位
开源动态8

DeepSeek-R1发布后的100天复现之旅方法总结

DeepSeek团队发布「推理大模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理大模型与普通大模型区别、复现方法、关键发现及未来方向。

深度学习自然语言处理
产品应用8

把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率

上海交通大学联合Sema研究团队推出SemaPLC,将AI Agent与PLC工程工具链连接,让自然语言需求转化为可编译、验证、仿真的控制程序。它是面向全流程的智能工作台,实验效果优于业界方案。

量子位
算法论文8

让机器人学会“预判接触”:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题

它石智航联合四大顶尖机构发布论文“TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在精细操作领域取得关键进展。

量子位
新闻资讯7

玻璃基板突然加速

AI算力行情推进,玻璃基板行情被京东方与康宁合作引爆。英特尔和台积电想用玻璃基板替代主流载板,虽想法合理,但落地需谨慎。英伟达推动其商业化,面板产业也积极助力,不过仍有技术难关待闯。

远川科技评论
新闻资讯8

Dario访谈首曝:Mythos被称为「超级武器」

Bloomberg主持人与Anthropic CEO Dario Amodei进行69分钟访谈。谈及Mythos模型强大危险不敢发布,还探讨AI递归自改进、文明崩塌概率、白领工作消失等问题,Dario坦率面对技术矛盾。

新智元
算法论文8

Speech LLM 的下一个突破口:你的语音大模型可以是个「带韵律的文本模型」

语音大模型存在‘模态代沟’致性能‘降智’,此前两波改进未根本解决。香港中文大学论文提出TextPro - SLM架构,从输入破局,仅用约1000小时数据就实现低‘模态代沟’,对多模态模型设计有启发。

机器之心
算法论文8

软体机器人控制难题获解,比传统方法节能75倍,还能闭眼干活

美国两校研究人员结合生物学与人工智能工程学,用‘神经储备池’技术控制生物混合软手臂,实现稳定追踪、自我感知和低能耗运行,还在多方面展现优势,目前研究处于仿真阶段。

DeepTech深科技
新闻资讯8

突破三维感知瓶颈:魔芯科技发布VGGT系列成果,实现动态高保真重建并获新一轮融资

魔芯科技联合同济大学等团队,基于 VGGT 架构发布四项成果,突破三维感知在流式处理、动态鲁棒性和精细感知上的瓶颈。还获新一轮融资,后续将加大对空间智能与世界模型技术投入。

机器之心
新闻资讯8

Claude彻底起飞!狂揽亚马逊5GW算力+250亿刀,贝索斯赚麻了

4月20日,Anthropic与亚马逊签署超级大规模AI基础设施协议,1000亿美元十年砸向AWS算力,锁定5吉瓦用于训练和部署Claude。亚马逊追加投资,Anthropic营收猛增,此合作揭示AI竞争转向基础设施。

新智元