「研究框架」共找到 3256 篇相关文章
EvoSkills:自进化的skill,是好skill
文章分享两项Agent Skill最新研究论文,指出智能体技能从手工制作向自动进化转变。介绍EvoSkills和EvoSkill两种自动化Skill进化方案,对比其机制、验证方式等,还提及未来研究方向。
竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500
大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在多评测中表现强,提升不靠增加token。
OpenAI联合创始人Greg Brockman:对话黄仁勋、预言GPT-6、我们正处在一个算法瓶颈回归的时代
OpenAI联合创始人Greg Brockman在AI.Engineer对话分享,还与黄仁勋连线。他回顾经历,从数学梦到编程,在Stripe、OpenAI发展。谈及多方面看法,如创造动机、工程研究关系、AI未来,指出算法瓶颈重回关键。
AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型
文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。
The Batch: 871 | Mistral测量了大语言模型的能耗、水耗与物料消耗
法国AI公司Mistral发布对Mistral Large 2的环境分析报告,涵盖全生命周期影响。研究表明单次使用影响小,但累计负担大。虽研究有不足,但其方法或推动环保型AI发展。
医疗AI智能体全面综述:行业爆发,年增长130%!
研究人员发布医疗健康AI智能体全面综述,梳理其全生命周期。数据显示截至2025年相关论文较2024年增超130%。研究前沿在数据、技术、应用上扩展,同时指出面临的挑战与未来方向。
何恺明新身份:谷歌DeepMind杰出科学家
网友爆料何恺明加入谷歌,经确认他以兼职形式成为谷歌DeepMind杰出科学家。可根据其近期研究推测研究方向,他还探讨生成模型能否走向端到端。何恺明履历辉煌,成果众多。
Anthropic让9个Claude Agent花5天做出比人类强4倍的对齐成果
Anthropic发表Automated Weak - to - Strong Researcher,用9个并行的Claude Opus Agent组成自动化研究团队,5天就把PGR从人类的0.23提升到0.97,成本约$18,000,证明AI自动化研究可行。
刚刚,Anthropic发现Claude「类意识工作台」!神秘J空间藏着没说出口的想法
Anthropic新研究发现Claude内部存在特殊“J空间”,像静默心理工作区,浮现模型思考概念,不一定在回答里。此研究受关注,还揭示其特性、发现方式及应用,改变对Claude“心智”理解。
80万条数据揭示隐患:AI正在「污染」病历,你的诊疗数据可能越来越不靠谱
新加坡国立大学等机构团队研究显示,AI生成临床文本用于训练新模型,会使病理信息在数据迭代中消失,降低医疗AI诊断可靠性。研究分析80多万条合成数据,还提出缓解方法。