多步推理」共找到 5589 篇相关文章

推荐文章7

AI 产品范式探讨:非线性思维、 Agent 协作才是复杂任务的更优解

本文探讨AI产品范式,指出当前大模型产品设计将其视为‘万能单兵专家’,但复杂任务下效果不佳。提出群体智能、非线性思维等观点,阐述人机协作方向,介绍新范式及AI产品商业化核心是信任。

Founder Park
算法论文8

14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~

有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经骤训练,实验显示其在检索能力和泛化性上表现出色。

PaperAgent
开源动态8

刚刚,大模型装上「鹰眼」!首创高刷视频理解,谷歌Gemini 2.5完败

面壁智能开源MiniCPM-V 4.5模态端侧模型,8B参数越级反超72B巨无霸,在领域达SOTA。它首创高刷视频理解,性能强、效率高、适合端侧部署,还实现技术创新,是开源端侧模态AI的革命。

新智元
开源动态8

揭秘开源Agentic‑Doc真能支撑120 W+ 查询?医疗/金融/法务都在用,确实是有这么 6~~~

LandingAI的Agentic Document Extraction是领先OCR且具视觉结构化能力的Python SDK,可处理复杂文档。它功能丰富,架构合理,支持格式输出。在行业有应用,性能提升显著,与同类项目相比优势明显。

小华同学ai
开源动态7

非Transformer架构的新突破,液态神经网络的推理小模型只用900M内存

谷歌提出的Transformer架构基本垄断大模型,而初创公司Liquid AI研发的液态神经网络架构另辟蹊径。其发布并开源的LFM2.5 - 1.2B - Thinking模型,仅需900MB内存就能在端侧运行,性能优于Transformer架构模型,还降低了死循环生成比例。

机器之心
开源动态8

让OpenAI只领先5天,百川发布推理新模型,掀翻医疗垂域开源天花板

百川智能发布医疗推理大模型Baichuan - M2 - 32B,在OpenAI的Healthbench评测集上超越刚发布5天的gpt - oss - 120b,领先数前沿模型,支持RTX4090单卡部署,还首创患者模拟器和Verifier系统。

量子位
新闻资讯7

刚刚,国产GPU赛道又跑出一个 2700 亿估值独角兽!“中国AMD”沐曦股份完成 IPO,开盘大涨超 500%

2025年12月沐曦登陆科创板,股价达679元/股,估值破2700亿。其定位全栈GPU提供商,产品覆盖领域。2022 - 2024年营收三年复合增长率超4000%,但累计净亏损超30亿。核心团队来自AMD。

InfoQ
新闻资讯8

奥特曼:ChatGPT只是意外,全能AI智能体才是真爱!Karpathy:7年前就想到了

当全球为ChatGPT喝彩,OpenAI的MathGen团队秘密锻造AI「推理」能力,打造全能AI智能体。OpenAI坚信推理能力可复制到各领域,未来AI智能体将颠覆一切,如今围绕人才的战争已白热化。

新智元
开源动态8

4K Star的人 Agent 协作平台 Multica!Agent即队友,可像同事一样被指派、被追踪!

当前 Agent 协同缺乏统一管理和经验沉淀,GitHub 开源的 Multica 平台解决了这一问题。它把编码 Agent 变成队友,自动化处理任务,支持 Agent 后端,有种功能特性,提供云服务和自托管两种使用方式。

开源星探
开源动态8

6.6K Star 打破次元壁!MCP-Use开源爆火:6行代码让LLM操控万物!

在AI Agent开发热潮中,MCP-Use作为开源Python库爆火。它用6行代码让LLM操控万物,支持模型、服务器,提供安全机制,适配网页浏览、3D建模等种场景,降低AI Agent开发门槛。

开源星探