数学构造」共找到 378 篇相关文章

新闻资讯8

00后的他们,正在定义AI时代的新坐标丨红杉中国联合《麻省理工科技评论》中国发布“25岁以下AI创新青年先锋”

AI领域创新正由年轻一代推动。红杉中国与《麻省理工科技评论》中国发起“AI25”计划,揭晓2025年“25岁以下AI创新青年先锋”入选者名单,他们在各领域成果突出,未来还将打造AI原生社区。

DeepTech深科技
算法论文8

Agent搜索哪家强?人大高瓴&快手联合发布全新评测基准GISA

人大高瓴与快手联合发布全新评测基准GISA,用于评估智能体搜索能力。它解决了现有基准反向构造、评估维度单一、答案易被记忆等问题,含373个高质量查询,实验显示当前搜索智能体距人类水平差距大。

PaperAgent
开源动态7

AgentIF-OneDay 发布,评估全场景长时复杂任务

红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。

特工宇宙
新闻资讯8

GPT-5.2果然反超谷歌Gemini 3 Pro!北大数院校友核心贡献

OpenAI在成立十周年推出GPT - 5.2,相比GPT - 5.1在多实用领域更强,视觉理解等能力提升。ARC - AGI测试中得分超谷歌Gemini 3 Pro。拆解其多方面能力,还介绍核心团队多为数学专业新面孔。

量子位
推荐文章7

深刻理解Token:大语言模型(LLM)是如何看待这世界?

文章指出在大语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
算法论文8

五倍推理加速,激发自回归潜能,苹果新工作让LLM预测未来

近年来自回归训练方法成语言模型主流范式,但推理阶段计算开销大。苹果研究人员开发框架,让预训练自回归大模型多 token 预测,代码和数学任务推理加速达 5.35 倍,一般任务约 2.5 倍。

机器之心
产品应用8

Kimi K2 详测|超强代码和Agent 能力!内附Claude Code邪修教程

作者熬夜带来 Kimi K2 模型详测及 CC+K2 邪修教程。K2 是 1T 参数量的 MoE 开源模型,基准测试成绩优异,在代码、Agent、数学推理任务表现突出,前端能力强,还能驱动 Claude Code,成本低。

歸藏的AI工具箱
产品应用7

我承认,我还是把AI应用想简单了

过去我们把AI应用想得简单,仅定义为聊天框等。生成式AI可构造全新产品逻辑,催生AI原生应用。‘1000 AIdea应用计划’涌现诸多创意作品,如火星种土豆、星童伙伴等,6月20日上海峰会将展示成果。

InfoQ
产品应用8

帮大模型提速80%,华为拿出昇腾推理杀手锏FlashComm,三招搞定通算瓶颈

在大模型推理通算难题凸显的背景下,华为数学家祭出 FlashComm。它包含三项技术,分别在 AllReduce 通信、以存换传、多流并行方面优化,解决通信瓶颈,提升推理性能,未来还将围绕多方向创新。

机器之心
新闻资讯7

陶哲轩联手AI挑战经典ε-δ极限!加法秒杀、乘法翻车

数学大师陶哲轩第三支Lean 4自动化数学证明视频,携手GitHub Copilot挑战「ε - δ」极限问题。Copilot处理加法较顺,减法卡壳,乘法失控。复杂证明时它短板尽显,陶哲轩认为复杂证明还得靠人脑。

新智元