「复杂决策」共找到 1234 篇相关文章
苹果拆解AI大脑,推理模型全是「装」的?Bengio兄弟合著
苹果最新研究揭示大推理模型(LRM)在高复杂度任务中普遍‘推理崩溃’。即便给予明确算法提示,模型亦无法稳定执行,暴露推理机制的局限性。研究还通过多种实验环境分析了模型在不同复杂度问题中的表现。
Memvid:把你的文档库变成一个小巧的视频,还能瞬间搜出你想要的!
传统向量数据库因高成本和复杂运维让开发者却步。开源项目Memvid将文本数据存入视频文件,能高效检索,解决存储冗余、检索延迟和网络依赖问题,使用简单,虽处概念原型阶段但值得尝试。
清华许华哲:具身智能需要从 ImageNet 做起吗?
清华许华哲探讨具身智能,分析其爆发原因、失败模式及决策点,涉及视觉信号输入、触觉应用、学习方法等,还探讨具身智能是否需‘ImageNet时刻’,并从宏观视角谈智能的共性。
Qwen3家族训练秘籍公开:思考/非思考融进一个模型,大模型蒸馏带动小模型
Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“大带小”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。
金属探伤微小缺陷:YOLOv11 改进,漏检率从 54% 降低到 19%
工厂质检工作累且易出错,用摄像头加AI检测,需模型在复杂车间环境识别微小缺陷。论文对YOLOv11改进,插入三个即插即用模块,降低漏检率、提升精度,还做了公平实验,公开数据。
【翻译】在 Codex 中使用 Goals:长时间工作的持久目标
文章介绍 Codex 中的 Goals,它是持久目标,能让线程跨多轮对话朝明确结果推进。阐述了 Goals 与普通 prompts 的区别、编写方法、活跃后的变化、设计方式及适用场景等,还通过案例展示其在研究任务中的应用。
神秘模型「大象」:仅100B拿下SOTA,Token效率超高!
神秘模型「大象」面纱揭开,它出自蚂蚁Inclusion AI团队,仅100B大小,是同规模SOTA且省Token。经多方面实测及权威榜单评测,它快、准、省,能胜任多数日常工作,但也有不擅长的领域。
The Batch: 943|液体和气体如何运动
传统数值方法模拟复杂物理系统慢且贵,基于机器学习的模拟通常只适用于特定系统。研究人员构建通用 transformer 模型 Walrus,可模拟流体运动,开源且在多方面表现出色,有望加速多领域模拟工作。
断腿也能跑!97小伙研发乐高式机器人,每个模块独立自主,断臂后秒变三脚怪兽继续狂奔
近日,美国西北大学博士生余琛团队研发出全新模块化机器人,由独立智能腿模块组成,能像乐高自由组合,可在复杂户外奔跑,断腿后也能继续前进,在多领域有应用潜力,相关论文已发表。
Prompt、Skills、MCP:大模型上下文工程核心链路
文章聚焦大模型上下文工程,介绍了Prompt、Skills、MCP核心链路。Prompt是与模型沟通基础,但其有脆弱、难管等痛点,促使向上下文工程演进;Skills是能力单元,可显式化能力、动态组合;MCP解决能力集成问题,虽有争议但理念重要。