「工程落地」共找到 1627 篇相关文章
南开 && UIUC | SearchAgent-X,打破「效率瓶颈」,让复杂「AI搜索智能体」走向现实
南开大学和伊利诺伊大学厄巴纳 - 香槟分校的研究提出SearchAgent - X框架,解决大型语言模型驱动的搜索智能体效率痛点。它剖析制约效率的原因,通过两大‘加速引擎’优化性能,实验显示效果显著。
在软件工程中,对 AI 的过度依赖,会加速工程师的无能
资深软件工程师Doug Slater指出,在软件工程中对大语言模型(LLM)过度依赖会加速工程师无能。LLM无法取代人类批判性思维,它在输出、输入、开发速度和用户技能等方面存在风险,且无法掌握程序理论和抵抗程序熵。
汤道生:腾讯持续加大 AI 投入力度,各项业务全面拥抱 AI
腾讯集团汤道生在 5 月 21 日峰会表示,生成式 AI 可用性质变,腾讯会加大投入,业务全面拥抱 AI。还提出‘四个加速’打造‘好用的 AI’,并介绍混元大模型、智能体等应用成果。
大模型推理加速全链路:内存管理、编译优化、量化与并行策略
本文整理自金煜阳博士在QCon大会分享。介绍大模型推理挑战,如规模增大、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。
数学大佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?
菲尔兹奖级纯数学成果落地大模型训练。佛罗里达大学团队用三维挂谷猜想解决大模型“黑盒问题”,GeoLAN加几何约束,效果显著。菲尔兹奖得主Jacob将入职OpenAI,AI在数学领域成果频出。
他想让TPU成为AI界的X86!
2026世界人工智能大会期间,中昊芯英主办分论坛,新一代全自研TPU架构AI芯片“须臾®”亮相,华东地区首个国产TPU智算千卡集群落成。“须臾®”算力强、成本低,集群全链路国产化,中昊芯英探索TPU突围路径。
DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家
一家成立不到两年的香港AI公司维纳智能,不堆参数、不依赖人工标注,靠让大模型自动生成高精度推理数据登上Nature通讯。其技术可解决Agent泛滥的困局,还推出特色产品,业务增长快。
可复制的 AI Coding 全栈实战:比 OpenSpec 更轻量、更丝滑
本文整理自淘宝闪购邓立山在 QCon2026 北京站演讲,分享其团队一年多 AI 编码全栈实战经验,分析 AI 编码问题,提出解决方案,介绍方案演进、实战案例及推广情况,还探讨了未来演进方向。
大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!
Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。
重生之我在AI时代当老板:让一群Agent互相PUA
MiniMax推出新Agent Mavis,可组建团队完成任务。其Agent Team分工明确,能解决单Agent在长程任务中的痛点,还将开源。此外,TokenPlan和Agent Plan合并,性价比提升。