腾讯元器」共找到 1240 篇相关文章

算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所、腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理
新闻资讯8

缔造OpenAI的秘密,竟只有一个词!新智十年峰会圆桌,七位大咖激辩

新智十周年圆桌论坛上,七位嘉宾探讨通往AGI与ASI的关键问题,如智能核心、AI能效、游戏与AI关系等。他们认为AI发展超预期,语言是智能核心,实现ASI关键在能耗,还谈及芯片与人脑差距、物理世界发展慢等话题。

新智元
新闻资讯8

成立半年连续获数千万融资,智子芯凭什么卡位国产算力生态?|甲子光年

智子芯成立半年获数千万天使轮融资。国产AI算力生态面临适配难题,该公司用“AI+运筹”解决。其核心技术“运筹学x大模型”,自研KernelCAT引擎,实现多场景高效交付,具泛化性。

甲子光年
算法论文8

“神经-符号”融合规划性能显著超越o1:借鉴人类运动学习机制|中国科学院磐石研发团队

中国科学院磐石研发团队提出新型“神经 - 符号”融合规划,融合神经与符号规划系统优势,借鉴人类运动学习机制构建双向规划机制,在规划覆盖率和效率上显著超越OpenAI o1,已加入“磐石·科学基础大模型”。

量子位
新闻资讯7

当智能醒于物理世界,英伟达副总裁: 下一个十年属于物理AI!|新智十周年峰会

在新智十年峰会上,NVIDIA副总裁赖俊杰揭示公司下一个十年战略核心——物理AI,它是继生成式AI和智能体AI后的下一波浪潮。物理AI与现实物理世界交互,但面临诸多挑战,英伟达为此开源Cosmos世界基础模型。

新智元
算法论文8

揭秘LLM“思考”之谜:推理即“梯度下降”,学习框架解构训练过程,还给优化提供新思路

上海AI Lab团队提出RaML框架,从梯度下降和学习角度揭示LLM“思考”机制。通过实证验证推理轨迹作为参数更新的合理性,还对比不同训练策略,指出RaML为优化LLM性能提供新思路。

量子位
算法论文8

正交化之外是什么?微软等提出ARO优化:训练提速1/3,揭示矩阵优化新「蓝海」

微软研究院联合多校发布论文,提出新优化 ARO。它将梯度旋转作为原则,能让大模型训练提速约 1/3,比 Muon 高效 10% - 15%,还能全模型优化,揭示了矩阵优化新方向。

机器之心
算法论文8

CNSNS|西工大曹文博、张伟伟:克服优化求解中的损失条件数瓶颈:一种良性损失函数

基于优化的偏微分方程求解方法受关注,但实际慢于经典迭代求解。本文从条件数角度审视效率瓶颈,指出标准MSE损失导致条件数平方放大、减缓收敛。提出稳定梯度残差损失SGR,在收敛速度与稳定性间建立平衡,实验验证其有效性。

力学与人工智能
产品应用8

鸿蒙服务的“体验密码” | 从京东到深圳万象城,看技术底层如何让服务直达用户

AI时代,系统能感知用户场景与需求,主动推送服务。鸿蒙服务解决用户体验痛点,其技术底座帮开发者“减负”。如京东复用代码,深圳万象城优化停车服务,还为中小商户提供零代码开发方案。

InfoQ