端到端可微分」共找到 2308 篇相关文章

新闻资讯7

摩尔线程科创板IPO注册获批

10月30日,摩尔线程科创板IPO注册获证监会许可,是科创板‘1+6’改革后高效完成注册的硬科技企业。其从受理过会仅88天,构建智算产品线,夸娥万卡智算方案优势明显。

芯师爷
新闻资讯8

韦东奕论文登数学顶刊,将散焦方程的爆破性研究扩展至d≥4

韦东奕和北大学者章志飞、邵锋合作的论文发表于数学顶刊《Forum of Mathematics, Pi》。他们将散焦方程的爆破性研究扩展至d≥4,成果填补空白,证明方法可推广其他方程。

量子位
算法论文8

西湖大学王东林团队论文:机器人需要“通古今,知未来”丨CVPR 2026

西湖大学王东林团队提出论文《HiF-VLA:Hindsight, Insight and Foresight for Vision-Language-Action Models》,介绍HiF-VLA模型,它以“运动”表达时间信息,实现稳定连续决策,性能提升且计算成本低,推动机器人从“看就做”“边想边做”。

AI科技评论
新闻资讯7

全网都在扒的小米MiMo团队,几乎被“北大学子”承包了

小米MiMo-V2-Pro模型登上OpenRouter调用量榜单第一后,网友关注其团队。该团队成立一两年冲顶尖,核心作者多来自北大,技术理念受小米产品基因驱动,成功是多重因素叠加结果。

量子位
产品应用8

不懂建模也能做角色!VAST升级AI神器,一手实测来了:一键拆建/魔法笔刷/万物绑骨

3D大模型明星初创公司VAST推出的Tripo Studio大升级,有智能部件分割、贴图魔法笔刷等四大核心功能,直击过去建模流程痛点,实现从“给模型”“交成果”的质变,提升全链路效率。

量子位
新闻资讯3

国外网友疯传DeepSeek R2/R3/R4 炸裂突破,超越传统的「跨因果超矩阵」,并在训练过程中自发产生了R5……

国外网友疯传DeepSeek R2R5的“重磅”消息,爆料内容层层递进且玄幻离谱。Anthropic联合创始人评价有认可也有轻视。当下闭源模型各领风骚,开源阵营期望集中在DeepSeek R2,应平常心看待传言。

AGI Hunt
算法论文7

低延迟、高吞吐,LLM优化与高效推理引擎综述

LLM计算成本高,用户要低延迟,企业要高吞吐。工程师开发优化技术,如动态批处理、KV缓存、模型量化。论文对比25款推理引擎,还探讨了多模态支持、手机推理、新型架构支持等进化方向。

深度学习自然语言处理
新闻资讯7

DeepSeek多模态真的来了?识图模式已开始小范围灰度

4月29日,DeepSeek多模态团队负责人陈小康在X发布动态暗示多模态进展。部分用户在DeepSeek官方App灰度“识图模式”,这是其主线产品首次有图像理解能力模式,此前多模态人才有流失,官方未说明开放细节。

DeepTech深科技
推荐文章8

程序员每十年就“要被取代”一次:这件事从 1969 年开始

文章回顾软件开发史,从 COBOL 如今的 AI 编程工具,每次新技术都承诺让编程变简单,但始终无法绕开复杂性。指出软件开发瓶颈在处理复杂性的思考能力,提醒用新工具时保持清醒。

InfoQ
推荐文章7

「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解

AI编程圈两极分化,围绕底层Harness是否消失争议不断。前Kimi CLI负责人stdrc提出反常识观点,认为模型越强Harness越厚,复杂度从“能力层”转移“协作层”,还以Kimi CLI实践及Raft创业为例阐述。

AI科技评论