结构化思维」共找到 1385 篇相关文章

算法论文8

华为多路径推理破解大模型数学瓶颈,准确率超97%|ICML 2025

大模型处理复杂问题常“翻车”,华为诺亚方舟实验室提出思维森林(FoT)框架,借鉴人类认知方式,打破线性推理范式。FoT在多个数学推理任务表现出色,准确率超先进模型,将在ICML 2025开源。

量子位
开源动态8

我去,还能这么玩?AI新宠DocExt:纯本地文档抽取,开源免费还无依赖!你还在为OCR头疼吗?

DocExt 是 Nanonets 开源项目,为全流程无 OCR、零云依赖的本地文档结构提取工具,适用于多种文档类型,支持字段与表格识别。它零 OCR 误差小、可本地部署,还能灵活接入模型。

小华同学ai
新闻资讯8

谷歌Gemini 3.2偷跑上线!2200行代码一镜到底,Claude/GPT坐不住了

发布会未开,谷歌Gemini 3.2 Flash网页端静默上线,编码实力强悍,代码量大幅提升。其核心技术是蒸馏与稀疏,推理成本大降。Gemini App集成第三方应用,谷歌I/O大会多款产品将曝光,此次发布对谷歌至关重要。

新智元
开源动态8

刚刚,DeepSeek多模态技术范式公布,以视觉原语思考

DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型。

机器之心
新闻资讯7

DeepSeek V3.2爆火,Agentic性能暴涨40%解密

文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。

新智元
算法论文8

重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路

2024年以来,RLVR使大模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在多模型和数据集上性能提升显著。

深度学习自然语言处理
产品应用7

Anthropic 深夜发布 Claude Design,一句话生成 UI,百亿美元市值 Figma 股价跌了 4.6%

Anthropic 发布新产品 Claude Design,由 Claude Opus 4.7 支持,以研究预览形式向部分用户开放。它定位为设计师“搭子”,覆盖多设计工作流。网友评价高,但也有人指出其生成结果有同质问题,对传统设计工具冲击待察。

InfoQ
新闻资讯8

清华给电子显微镜加上Agent,DeepSeek V3全程调度,数天流程缩短至几分钟

清华大学牵头,联合多机构推出电镜领域AI Agent AutoMat,它能把原子级STEM图像转成标准CIF结构并给出关键物性,将人工流程缩短至几分钟。它还构建数据集验证,性能超现有工具,不过也有瓶颈待解决。

量子位
算法论文8

港大团队首创静电捕获术,实现纳米金刚石晶圆级规模集成

香港大学褚智勤团队与多方合作,首创基于静电捕获的方法,5分钟就能在8英寸晶圆上阵列排布单个纳米金刚石,良率达82.5%。该方法操作简便、成本低且与CMOS工艺兼容,有望推动纳米金刚石量子技术商业

DeepTech深科技
新闻资讯7

Teleport 报告:AI 安全事件频出,背后往往是过度授权

Teleport报告指出,为AI系统授予过度访问权限的企业,安全事件发生率是权限管控合规企业的4.5倍。身份管理体系建设跟不上AI落地速度,精细权限授予是关键,还给出搭建统一身份层等建议。

InfoQ