「多步推理」共找到 5669 篇相关文章
薛定谔亲外孙创业量子计算,老黄早早就成了股东
PsiQuantum由薛定谔外孙参与创办,获10亿美元巨额融资,欲2028年造百万比特级量子计算机。其量子比特基于光子,有生产优势,不过纠错能力待验证。公司团队学术背景强,项目多为政府大单。
谷歌 DeepMind 推出 CodeMender:自动修复代码的智能代理
谷歌DeepMind推出CodeMender,这一AI驱动的智能代理能自动检测、修复并加固软件漏洞。它结合多种技术推理程序行为,生成修复方案经自动测试和人工审核后提交。社区反响积极,长期影响待察。
具身智能算法哪家强?RoboChallenge见真章!全球首个大规模真机算法评测平台来了
Dexmal原力灵机联合Hugging Face推出RoboChallenge项目,它是全球首个大规模、多任务的真实物理机器人基准评测平台。该平台创新采用‘远程机器人’架构,有30项真实任务基准集等,已验证多种算法表现。
OpenAI算力账单曝光:70亿美元支出,大部分钱花在了“看不见的实验”
据Epoch AI统计,去年OpenAI计算资源支出70亿美元,多以租微软云算力支付。其中50亿研发算力,大多用于幕后研究和实验,非爆款模型的最终训练,也解释了其2024年亏损原因。
北大 & 作业帮团队提出 Text-to-SQL 新框架 Interactive-T2S,攻克宽表处理与低资源对齐难题
北大与作业帮联合研发的论文提出 Interactive-T2S 框架,将 LLM 塑造成智能代理,通过多轮交互解决传统 Text-to-SQL 方法在宽表处理、低资源对齐等方面的难题,已入选国际顶会 CIKM2025。
53.7% 高学历政企人员“看走眼”!公文写作AI智能体首次通过图灵测试
2025数博会期间双盲测试中,53.7%高学历政企人员将‘方寸智脑’生成公文误判为人类作品。它与华为云合作,解决政务AI落地困局,实现政务公文写作三阶跨越,已服务众多用户。
一篇大模型Agentic框架到应用最新综述
这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。
一文读懂DeepSeek-V3.2核心技术DSA:API疯狂降价性能不减的背后
DeepSeek发布实验模型DeepSeek V3.2,引入自研稀疏注意力机制DSA,API价格最高降75%。DSA先筛选后计算,含闪电索引器和稀疏多潜在注意力两组件,分四步工作,权衡了精确性与速度。
0.07B大败QwenVL72B!百度开源OCR3.0"三件套"
OCR 历经四次范式迁移,工业落地存在精度与参数量等矛盾。百度开源 PaddleOCR 3.0“三件套”,含 PP - OCRv5、PP - StructureV3、PP - ChatOCRv4,各有创新点,解决了多语种识别、版面还原等问题。
云栖大会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!
云栖大会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。