「AI自我构建」共找到 10650 篇相关文章

算法论文8

机械手真正「活」了,银河通用&清华推出DexNDM,用神经动力学重塑灵巧操作

银河通用与清华推出DexNDM,旨在解决灵巧操作技能sim - to - real难题。它能让灵巧手掌握多种转轴、多样手腕朝向下旋转物体的技能,构建的半自主遥操系统可完成复杂工具操作和长程装配任务,在sim - to - real方法上有创新。

机器之心
开源动态7

三重Reward驱动的运维智能体进化:多智能体、上下文工程与强化学习的融合实践

文章阐述了AI原生时代下,面向技术风险领域的智能体系统(DeRisk)的架构设计、核心理念等。介绍运维智能体发展现状,提出其技术演进需找三类Reward,还介绍相关概念、DeRisk架构,给出实践案例并将开源技术产品。

阿里云开发者
推荐文章8

端到端语音模型:从语音表征到模型架构

本文整理自阶跃星辰语音模型负责人杨学锐在2025年QCon全球软件开发大会的分享。介绍大模型对语音技术的重塑,涵盖识别、合成等方面;阐述端到端语音模型构建,涉及表征、架构、训推和任务;还提及模型评估方法。

InfoQ
算法论文8

英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限

学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。

机器之心
新闻资讯9

Claude独立攻克理论物理前沿难题,全程无人指导,花费不到两千美元

本文报道Anthropic旗下大模型Claude在几乎无人指导的情况下,独立完成理论物理前沿难题——平面N=4超杨-米尔斯理论九圈六胶子散射振幅计算,总成本不到两千美元,中科院团队也借助GPT-6得到结果,业内探讨了AI在科研中的能力边界。

DeepTech深科技
新闻资讯7

存储芯片领域又冲出一家IPO!年入37亿

AI驱动存储“超级周期”,行业巨头提价,国内存储芯片公司股价上涨。深圳晶存科技9月底递表港交所,此前募资超7.06亿,2024年末投后估值37亿。虽净利润为正,但经营现金流持续为负,全球嵌入式存储市场市占率约1.6%。

芯师爷
算法论文8

谷歌新研究:大模型“吵架”有利于提升推理质量

谷歌新研究发现高级推理模型自发进化出'思想社会',研究人员用LLM - as - judge方法识别出多个虚拟人格。还找到控制现象的'开关',实验表明教AI'吵架'更有效,其'社交技能'通用,给开发者带来新启示。

AI工程化
开源动态7

智谱新模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
算法论文8

GUI智能体训练迎来新范式!半在线强化学习让7B模型媲美GPT-4o

浙江大学与通义实验室团队推出UI - S1,提出半在线强化学习训练范式。它融合离线与在线学习优势,用三项关键技术构建核心架构,新评测指标SOP更贴近真实表现,实验显示UI - S1 - 7B性能卓越,逼近GPT - 4o。

量子位
开源动态7

非Transformer架构的新突破,液态神经网络的推理小模型只用900M内存

谷歌提出的Transformer架构基本垄断大模型,而初创公司Liquid AI研发的液态神经网络架构另辟蹊径。其发布并开源的LFM2.5 - 1.2B - Thinking模型,仅需900MB内存就能在端侧运行,性能优于Transformer架构模型,还降低了死循环生成比例。

机器之心