「深度搜索」共找到 1121 篇相关文章
Skills的最正确用法,是将整个Github压缩成你自己的超级技能库。
文章指出重复造轮子不可取,Skills可将Github开源项目封装成技能库。以FFmpeg、yt - dlp等为例,介绍封装流程,还提及多场景应用,如视频下载、格式转换等,让普通人能利用开源成果。
定位大模型「作弊」神经回路!新研究首次揭示:虚假奖励如何精准激活第18-20层记忆
此前学术界发现大模型用虚假奖励训练也能提升准确率,背后微观机制是黑盒。南科大等团队深度拆解,定位到关键记忆节点,发现‘困惑度悖论’,还能操控记忆,成果对评估、检测和去污染有意义。
效果、性能双突破,快手OneSug端到端生成式框架入选AAAI 2026
查询推荐是电商搜索关键功能,传统方法有局限。快手提出OneSug端到端生成式框架,统一多阶段,提升效果与效率,成果入选AAAI 2026,已在快手电商全量推广,显著提升多项指标。
不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化
随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
清华大学等联合研发的 AgentCPM-Explore 智能体模型,基于 4B 参数在深度探索类任务表现出色,有打破参数壁垒等亮点,还全流程开源,解决小模型性能提升挑战,邀伙伴共建端侧智能体生态。
大模型狂叠 buff、Agent乱战,2025大洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?
InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨大模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了大模型、Agent、AI Native等发展趋势。
别人在测 Demo,我已经用MiniMax M2.1跑通了整个产品开发流程
作者黄叔用自研产品「降噪」测试 MiniMax M2.1,从 Skills 优化、页面样式、沉浸式交互、智能搜索四个维度检验实战能力。结果显示 M2.1 优势明显,虽有不足,但已能满足多数日常开发任务。
Ilya 最新访谈,预训练时代终结后,AI行业来到了哪里?
Ilya接受90多分钟深度访谈,指出当前大模型泛化能力远不如人,Scaling时代终结,研究时代回归。还谈到AI经济影响与跑分不匹配、泛化能力鸿沟、情感价值等问题,预测超级智能5 - 20年到来。
Ilya重磅发声:Scaling时代终结!自曝不再感受AGI
Ilya在与主持人Dwarkesh Patel的深度访谈中爆出惊人观点,认为Scaling时代已终结,我们正走向研究时代。他指出当前技术路线后劲不足,模型泛化能力远逊人类,还探讨了AI发展的诸多关键问题。
安谋科技Arm China闪耀2025全球计算大会|赋能绿色算力,加速AI普惠
安谋科技Arm China受邀出席2025全球计算大会,参与多项活动。深度参与撰写《算力经济绿色研究发展报告》,推进本地化标准建设,还在具身智能领域发力,其“周易”NPU IP将助力具身智能落地。