收敛速度」共找到 680 篇相关文章

产品应用8

全球首个从语言出发构建的智能体:MoonBit Pilot 如何推动自动化软件交付?

MoonBit Pilot是从语言底层构建的代码智能体系统,将AI Agent从“助手”推向“合作者”。它比Cursor、Codex更快更稳定,能云端异步执行,有Sub Agent架构和分段编译机制,或成未来软件工业新标准。

AI科技评论
新闻资讯8

我国科研团队,突破了存算一体技术瓶颈

AI浪潮倒逼半导体产业创新,存算一体技术应运而生。但该技术应用存在问题,排序难题制约其发展。北大团队国际首次实现基于存算一体技术的高效排序硬件架构,成果发表在《自然∙电子》。

芯师爷
新闻资讯7

DeepSeek流量暴跌?AI大模型全球霸主离奇遇冷,外媒曝出真相

曾以低价高性能出圈的DeepSeek,在自家平台遇冷、市场份额下滑,但其R1和V3模型在第三方平台使用量增长近20倍。背后是‘Token经济学’及战略转移,它开源模型,将算力留作研发。Anthropic也因算力受限有类似问题。

新智元
算法论文7

机器狗能当羽毛球搭子了!仅靠强化学习从0自学,还涌现出类人回位行为 | Science子刊

苏黎世联邦理工学院团队让机器狗靠强化学习学会打羽毛球,开发全身视觉运动控制策略,使其最高挥拍速达12米/秒,还涌现类人回位行为,研究证明足式机器人在体育场景应用可行。

量子位
新闻资讯8

首批GPT-6内测结果好离谱啊。。。

GPT - 6使用资格分批开放,内测玩家抢先体验。其在3D生成、游戏开发、网页制作等多领域表现出色,如15分钟做出Mac应用,空间推理达世界级水平,但运行时Token消耗大。

量子位
产品应用7

给 AI 一张陶罐碎片图,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐图,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题。

AI科技评论
算法论文8

条条电路通罗马:大模型可解释性的「唯一机制」可能从一开始就不存在

长期以来,机制可解释性领域默认模型对同一任务的能力对应唯一内部「电路」。但被ICML 2026接收的新论文指出,「唯一电路」可能不存在,同一任务可由多个结构不同但能力相当的电路完成。

机器之心
推荐文章8

为什么算力追赶这么难?前谷歌架构师现场黑板推演底层架构,看懂芯片底层逻辑里被忽视的“空间博弈”

前谷歌架构师、MatX CEO Reiner Pope在访谈中从基础逻辑门讲起,推导芯片架构,指出芯片大部分成本花在搬运数据上,还探讨乘加运算、脉动阵列等原理,以及时钟周期、FPGA与ASIC差异等内容。

AI科技大本营
开源动态8

加速量子计算到来!英伟达开源模型拉爆量子计算股

英伟达发布并开源全球首个加速量子计算应用的模型系列Ising,打破硬件校准和纠错耗时难题,提供比传统方法更快、更准的量子纠错解码能力,还推出校准基准测试,全方位开源吸引众多机构加入。

AIGC开放社区
新闻资讯8

内存减6倍、精度0损失,推理提速8倍!谷歌新技术震撼了AI圈

Google Research团队推出TurboQuant技术,能将KV缓存6倍压缩、无精度损失,推理速度提升8倍,解决内存瓶颈问题,为大语言模型应用扫清障碍,引发业界关注,还致存储芯片巨头股价大跌。

AIGC开放社区