「深度学习研究」共找到 3488 篇相关文章
把20多种工具塞进一个搜索框!亲测「Agentic Search」后,我关掉了几十个浏览器标签页
秘塔AI推出Agentic Search,是“边想边搜,边搜边做”新搜索方式,能自主完成多步工具调用。作者测试其为AI笔记应用策划预热活动等场景,还测市场分析、编程学习、新媒体运营场景,虽有不足但未来可期。
ICML 2026 开幕,清华团队获最佳论文奖,DeepMind 经典巨作拿下时间检验奖
2026年7月6日,第43届国际机器学习大会(ICML 2026)在韩国首尔开幕,投稿规模与录用总数破纪录。会上,清华黄高团队论文获杰出论文奖,指出扩散语言模型“灵活性陷阱”;还有多篇论文获荣誉提名,另有立场论文、时间检验奖等揭晓。
高德纳:「震惊!震惊!」Claude破解《计算机程序设计艺术》难题
著名计算机科学家高德纳在论文中表达对AI强大能力的震惊,其朋友借助Claude Opus 4.6解决了他研究几周的开放性问题。Claude经31步探索给出Python构造程序,奇数情况获证明,偶数仍待解。AI在数学领域已取得多方面突破。
炸裂提速30倍!Meta提出REFRAF,无需改动模型,让RAG告别冗余与等待
近年来,RAG任务在提升模型回答质量的同时带来性能代价,Meta等团队合作提出REFRAG框架。它将无关段落压缩,引入强化学习选关键段落,实现高达30.85倍的TTFT加速,且无需改模型结构,实用性强。
Meta发布40页报告,具身智能的下一步是「心智世界模型」:能听,能看,能理解,会共情
Meta发布40页报告,首次将对人心智状态的推断概念化为心智世界模型,与物理世界模型实现“双轨建模”。还指出要结合系统A和B让AI自主学习,心智世界模型在多智能体协作潜力大。
纽约时报:AI会冲击谁的就业?年轻人还是资深员工?
在微软等科技公司裁员浪潮中,专家就AI会冲击谁的就业展开辩论。有人认为职场新人易被取代,也有人觉得资深员工更脆弱。不同研究指向不同结果,且一些公司已减少招聘初级或资深员工。
新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%
研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用性,训练扩展率比 Transformer++ 高 35%,推理性能提升 29%,还在多任务中表现出色,是扩展模型能力新范式。
构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理
企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。
M系列芯片一号人物准备离开,苹果高管流失正在失控
近期苹果高管变动不断,12月1日负责机器学习与AI战略的高级副总裁宣布退休,4日设计总监离职。此外,‘苹果芯片’之父也考虑离开,还有多位高管有离任计划。苹果发展策略保守,留不住人才,库克时代或近尾声。
10万字Claude系统提示词泄露!我用DeeSeek 将它翻译成了中文版
Claude完整系统提示在GitHub泄露,虽真假未确认,但值得分享供参考。作者用DeepSeek将其翻译成中文版,该提示涵盖模型行为、工具使用等多方面,设计精妙全面,是AI交互设计“百科全书”,对提示词工程师极具学习价值。