「研究框架」共找到 3256 篇相关文章
一篇95页最新80种Deep Research系统全面综述
浙大研究深度研究系统领域,分析自2023年以来80多个相关实现,提出4维度分层分类法,全面分析4种实现架构,还阐述各维度演变进步。
别再手写 Skill 了!微软最新研究:像神经网络一样训练 Skill
微软研究提出 SkillOpt 方法,把 Skill 文档当「权重」训练,在 52 个测试组合中全部最优或并列最优,平均提升 23.5 分,碾压人类手写。该方法跨模型、环境有效,已开源,使用方便。
Megatron 1F1B流水线并行中的负载不均衡问题研究
文章分析Megatron 1F1B流水线并行中负载不均衡问题。通过实验发现通信时间‘一短一长’,原因是最后一个Stage计算慢致不同步,额外计算引发通信延迟,还梳理了流水线各阶段执行过程。
夸克高考,背后藏着的其实是垂类场景「深度研究」方法论
夸克早在2019年就提供高考志愿填报服务,今年推出“志愿报告”功能。其“志愿报告”Agent已生成超1000万份报告,采用PDCA模式给出指导。夸克构建可信度体现在数据库和自研模型上,还降低了幻觉率。
人在美国,待过三家AI Lab,全凉了!
科技行业大裁员,Meta裁掉老将田渊栋,AI从业者人心惶惶。南洋理工大学副教授Boyang Li工作过的三家工业研究实验室全倒闭,他分享经历,探讨工业研究困难的原因。
一文讲清三种AI应用系统的架构及及TOP威胁框架
文章从AI系统分类及架构出发,分析不同类型AI系统的威胁特征,并介绍现有的威胁分析框架。目前AI应用架构经历从GenAI到AI Agents,再到Agentic AI的演进,各方向独立发展,且威胁各有特点又有重合。
Soul APP开源了一款高保真播客生成框架,90 分钟对话零崩盘!
Soul APP背后的Soul AI Lab发布开源项目SoulX - Podcast,是高保真推理框架,能生成90分钟以上连贯对话,有多方言切换等功能,或重塑语音内容产业生产方式。
LLM长文本内卷,谁是真英雄?告别跑分玄学,我们需要一把“公道秤”
OpenNLG Group做了统一长上下文评估框架LOOM - Scope,兼容主流benchmark、model和长上下文加速方法。该框架围绕BENCHMARK、DEPLOYMENT和EVALUATOR三大核心模块,还提出LOOM - Bench应对评估成本制约。
超轻量级Multi-agent,可独立用于生产,也可扩展LangChain、CrewAI、Agno
越来越多AI玩家加入Multi - agent领域,现有框架复杂冗长。本次分享可用于生产的超轻量级Multi - agent Water,它不依赖任何框架,还能扩展LangChain等,文中介绍其核心组成与上手教程。
比Gemini 3记得更多,谷歌新框架将上下文记忆干到了200万!
Google在NeurlPS2025大会推出结合RNN与Transformer的全新架构Titans,能扩展到超200万个token上下文。背后涉及Titans和MIRAS两篇论文,共同推进测试时记忆概念,实验显示新架构性能出色。