科学突破」共找到 1130 篇相关文章

算法论文7

实证:现在的LLM根本不会Reasoning!

论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。

深度学习自然语言处理
算法论文8

给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理

如今大模型长上下文推理面临计算成本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验中表现优异。

量子位
产品应用8

以加代乘?华为数学家出手,昇腾算子的高能设计与优化,性能提升30%!

大模型落地面临推理难题,华为团队基于昇腾算力发布三项硬件亲和算子技术研究,包括以加代乘的AMLA算子、融合算子技术、SMTurbo加速技术,实现能效、协同和速度突破,未来将拓展应用场景。

机器之心
算法论文8

北大DeepSeek论文或预定ACL Best Paper!梁文锋署名

北大DeepSeek联合发布的NSA论文已被ACL 2025录用且评分高,有望冲击最佳论文。该技术革新传统注意力机制,提升算力效率,是长文本处理的突破。此外,张铭教授团队还有多篇论文上榜。

新智元
新闻资讯8

国产大模型「五强争霸」,决战AGI!

中国基础大模型市场形成「基模五强」格局,包括字节、阿里、阶跃星辰、智谱和DeepSeek。它们要么有钱,要么有人,各有特色与优势。未来竞争焦点是追求更高「智能上限」和突破「多模态能力」,决战AGI。

新智元
新闻资讯8

Agent工程化最佳实践,AICon深圳2026来了

8月21 - 22日,AICon全球人工智能开发与应用大会将在深圳举办。大会邀请产业一线专家,围绕Agent工程化等前沿方向,分享技术探索与工程实践,探讨AI从能力突破走向系统构建的新路径。

PaperAgent
算法论文8

科学家发现大脑中的“旋转风暴”,其结构竟类似Transformer注意力机制

2026年6月18日,叶智文团队关于大脑旋转波的研究成果发表于《科学》。他们借助先进设备发现小鼠脑中旋转波,总结特征、验证其与全脑及行为关联,还指出其类似Transformer注意力机制,未来将继续深入研究。

DeepTech深科技
开源动态8

从服务器 OS 到 Agent 沙箱:腾讯云如何打通 AI Infra 的生态底座

文章指出代码生成快但执行边界缺可靠设施,腾讯云开源 Cube Sandbox 项目。它基于 MicroVM 路线,突破隔离、速度、密度等门槛,v0.2.0 版本降低部署门槛。与 OpenCloudOS 9 组合,提供全链路开源可控路径。

InfoQ
新闻资讯8

GPT-5.5全球首破!0源码盲写程序,编程AI进入新纪元

全网AI交白卷的ProgramBench编程基准,被GPT-5.5首破。它能0源码盲写程序,同一题用C和Python两种解法通过测试。相比之下,Opus 4.7表现不佳。这揭示推理算力成编程AI核心变量。

新智元
产品应用8

DeepSeek-V4发布!高效百万上下文智能普惠时代来了

DeepSeek-V4发布,是开源社区关键分水岭。它解决超长文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。

AIGC开放社区