两阶段推理」共找到 3126 篇相关文章

新闻资讯3

马斯克Grok 4正式发布:世界最大AI超级计算机就训练了这?

Grok 4公开基准测试有进步,但在高级推理测试表现差,视觉理解仍是短板。性能提升多靠整合符号工具,无重大技术创新,‘幻觉’问题没实质进展,xAI官方对道德对齐信心不足。

AI寒武纪
开源动态8

清华SageAttention3,FP4量化5倍加速!且首次支持8比特训练

清华大学陈键飞团队提出针对BlackWell架构的SageAttention3,实现5倍于FlashAttention的推理加速,首次支持8比特训练。在多种大模型上保持端到端精度,代码将分别于6、7月开源。

机器之心
新闻资讯7

十分钟破解加密货币!谷歌在量子计算领域发现了什么?

谷歌提前后量子密码迁移截止日期至2029年,篇论文从不同层面优化Shor算法,显示量子计算机破解现有密码体系所需资源比预想少。以太坊架构使其面临更广攻击面,比特币也有局部隐患。

机器之心
新闻资讯7

FDE 火了:个追求 AGI 的公司,为什么都开始「雇人上门」了?

OpenAI 收购 Tomoro 获 150 名现场部署工程师,Anthropic 联合机构成立新公司派工程师驻场。家顶尖 AI 公司均用几十亿美元买人,引入 FDE 概念,表明强大模型需结合现场服务释放 AI 能力。

特工宇宙
产品应用8

南华期货 x TencentOS:如何实现CentOS操作系统的“无感”切换?

2024年南华期货与腾讯合作,依托TencentOS Server完成200余套操作系统迁移,实现核心业务零事故切换。其分三阶段实施,TencentOS Server以无感迁移、稳定性强、利于生态协同等优势获选,迁移成效显著。

InfoQ
新闻资讯7

GPT-5:我更强了,就这?“看不见”的升级

OpenAI 发布 GPT - 5,它未带来 AGI 相关的震撼升级,而是更注重实用。其训练有新特点,具备推理强、编程能力提升等特性,是 AI 从‘模型炫技’到‘产品体验打磨’转变的标志。

MacTalk
新闻资讯7

先别急着给OpenAI加冕!陶哲轩:这种「金牌」,含金量取决于「赛制」

OpenAI 官宣推理模型在 IMO 获金牌水平成绩,此前各模型表现不佳。数学家陶哲轩劝谨慎看待,认为无严格测试条件难比较 AI 与人类。网友看法不一,模型训练方法及 Alexander Wei 受关注。

机器之心
算法论文8

AI数学能力暴涨100%,自进化直逼RL极限!CMU新作颠覆认知

数据枯竭成AI发展瓶颈,CMU团队提出SRT方法,让LLM自我进化,提升数学与推理能力,性能逼近传统强化学习。研究还分析其局限,提出缓解奖励作弊策略及应对模型崩溃的方法。

新智元
算法论文8

刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板

DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本大规模训练和推理,分析硬件特性对架构选择的影响,研究者相互依赖关系,还为未来协同设计提出建议。

新智元
算法论文7

谷歌TurboQuant会绕过“内存墙”?这个判断有点过了|甲子光年

谷歌发布的TurboQuant论文引发市场震动,其算法可将大语言模型推理的KV缓存大幅压缩并加速。但将其视为绕过‘内存墙’判断过度,它提升单位字节信息密度,改变边际需求曲线,代表范式转移。

甲子光年