「深度研究能力」共找到 5114 篇相关文章
微软研究院BioEmu登上Science,用生成式AI重塑蛋白质功能研究
7月10日,微软研究院AI for Science团队在《Science》发表成果,提出生成式深度学习模型BioEmu,结合多类数据训练,能模拟蛋白构象变化,有多项核心创新,已开源,未来将拓展应用场景。
给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理
如今大模型长上下文推理面临计算成本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验中表现优异。
别再手写 Skill 了!微软最新研究:像神经网络一样训练 Skill
微软研究提出 SkillOpt 方法,把 Skill 文档当「权重」训练,在 52 个测试组合中全部最优或并列最优,平均提升 23.5 分,碾压人类手写。该方法跨模型、环境有效,已开源,使用方便。
LlamaIndex 深度实战:用《长安的荔枝》学会构建智能问答系统
文章兼顾 RAG 科普与 LlamaIndex 实战。介绍 RAG 原理,用《长安的荔枝》讲解关键步骤和参数。实战部分展示用 LlamaIndex 搭建问答系统,代码量少。优化篇通过实验给出参数调优建议,架构篇剖析内部机制,最后提及 Agent 化拓展功能。
AI行业的底牌已经亮完了,模型能力趋同后,拼什么?
Databricks MVP Adi Polak分析AI人才需求,指出能搭建评估管道等的工程师是硬通货。前沿模型架构趋同,行业从技术竞赛转向生态战争,比拼产品和用户理解能力,还为转型工程师给出建议。
当我深度体验完这个AI社交产品之后,我悟了。
作者深度体验小众AI社交产品Second Me,介绍玩法,包括建AI分身、设置形象、输入记忆等,还能让AI分身聊天破冰。它做减法,帮用户固定自我,让社交更有价值,是I人社交利器。
Megatron 1F1B流水线并行中的负载不均衡问题研究
文章分析Megatron 1F1B流水线并行中负载不均衡问题。通过实验发现通信时间‘一短一长’,原因是最后一个Stage计算慢致不同步,额外计算引发通信延迟,还梳理了流水线各阶段执行过程。
深度拆解 Hermes Agent 的记忆系统:它如何修正 OpenClaw 的误区
文章深度拆解 Hermes Agent 记忆系统,介绍其四层记忆系统,包括提示词记忆、SQLite 历史会话存档、智能体技能管理和用户建模。与 OpenClaw 对比,Hermes 更关注缓存效率,遵循冷热分离、缓存优先等原则。
AI读不懂文档结构?计算所重构Agentic RAG文档推理能力
大语言模型工具使用能力推动RAG进化,现有Agentic Search框架有“结构盲”问题。中科院计算所团队提出DeepRead,将文档结构转化为坐标系统,用两大工具协同实现类人推理,在多数据集验证效果显著。
挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力
香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供新思路。