数学推理能力」共找到 4767 篇相关文章

算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。

机器之心
新闻资讯7

一篇文章告诉你:国产 GPU 背后的技术和商业路线异同

过去两年,国产 GPU 赛道进入公开财务与审视阶段。文章分析了摩尔线程、沐曦等企业不同技术与商业路线,如摩尔线程走“高启动+快扩张”,沐曦选“厚积薄发+先服务高端算力场景”等。

芯师爷
算法论文8

谷歌DeepMind最新论文,刚刚登上了Nature!揭秘IMO最强数学模型

谷歌DeepMind的AlphaProof在IMO获接近金牌的银牌成绩。它结合大模型直觉、强化学习和Lean形式化证明解题,虽在速度、泛化和读题上有局限,但开启了人类数学家与AI协作新阶段。

新智元
算法论文8

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!

论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。

机器之心
产品应用8

AI Code赛道跑出一匹黑马:字节Doubao-Seed-Code

字节发布面向Agentic Coding任务优化的编程模型Doubao - Seed - Code。它在代码能力、生态兼容性、价格上优势明显,在实际案例中表现出色,其训练体系独特,为开发者提供高性价比选择。

PaperAgent
开源动态8

AutoDev CLI:打造 AI 生成的 AI Agent 质量保障与验证架构

文章介绍AutoDev CLI,它基于AutoDev MPP架构构建,旨在解决上一代AutoDev智能体测试难题。阐述其起步、迭代、演进、集成过程,实现从AI生成代码到验证、生成测试系统的转变,带来可验证、可演化、可移植的优势。

phodal
算法论文8

三位AI殿堂级人物罕见同框:LeCun、李飞飞、谢赛宁团队用空间超感知让AI像人一样理解三维世界

谢赛宁团队联合杨立昆、李飞飞发布Cambrian - S研究,提出空间超感知概念,指出现有AI视频理解或被高估,推出VSI - SUPER基准测试,虽Cambrian - S模型有提升但仍有局限,预测性感知或成新范式。

AIGC开放社区
推荐文章8

李飞飞万字长文爆了!定义AI下一个十年

李飞飞最新长文指出,AI下一个前沿是「空间智能」,它能让「看见」升华为「推理」等。她揭秘了空间智能「世界模型」核心框架和三大核心支柱,还阐述了其应用领域及构建挑战。

新智元
开源动态8

Kimi K2 Thinking,最强思考模型,附实测

Moonshot AI发布Kimi K2 Thinking模型,它能边思考边行动,是目前最强开源思考模型,多项指标超GPT - 5等闭源巨头。其具独特架构,有性能优势,还给出部署方式,实测表现佳。

AGI Hunt
新闻资讯7

从扫街榜到Robotaxi,空间智能彻底打开了高德的想象空间

这周一,一张神秘海报引发对高德的猜测。11月5日,高德宣布与小鹏合作提供Robotaxi服务。其空间智能形成闭环,比语言模型更接近AGI,还能为Robotaxi提供安全保证,且在多领域有落地应用。

机器之心