「规划能力」共找到 3465 篇相关文章
几张GPU干翻超算!耶鲁AI颠覆化学合成,实验成功率71%
近日,耶鲁大学李昊特团队开发 AI 系统 MOSAIC,将化学合成知识分 2498 个领域训练专家模型。测试中对超 35 种新化合物合成成功率达 71%,还完成难反应与新反应,相关论文发表于《自然》。
8个AI顶流科学家,300亿估值:他们要让AI自我进化
AI初创公司Recursive结束隐身状态,公布八位联合创始人名单,完成6.5亿美元A轮融资,估值达46.5亿美元。公司旨在推动自我改进型人工智能发展,让AI学会科研,虽面临挑战,但受算力产业链关注。
“这个怎么组装?”一句无害的问题,如何让AI产生危险输出
Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。
裸辞北大博士带17个Agent,49天造出全球首个AI开放世界!成本仅5000
北大文科博士刘耕带17个Agent,49天、5000元成本、30万行代码造出全球首个AI开放世界Elseland。其玩法、世界、创造都具开放性,刘耕逆风突围,开发效率大幅提升。
一文搞懂 Coding Agent 和 Harness
文章介绍编码智能体和 Agent harnesses 设计,阐述 LLM、推理模型与 Agent 关系,指出 harness 是让 LLM 在特定任务更好用的关键。还详细讲解 Coding harness 六个核心组件,并对比了 OpenClaw。
Anthropic用GAN思路解决AI产出质量问题
Anthropic工程师发现AI会自我欺骗,无法准确评价自己工作。他们借鉴GAN思路,让Generator生成、Evaluator验收。校准Evaluator使其严格,还为前端设计定审美标准,实验证明挑刺搭档能提升AI产出质量。
前荣耀AI实验室主任带队:用“超级大脑”接管农场,24小时不打烊
浙江丘沃智能的AlphaFarm系统开启无人农场新范式,由前荣耀AI实验室主任汤泳等“AI极客”打造。该系统能自主决策执行、实时监控,有四大黑科技,经评估在农业垂直领域领先。
谷歌Gemini 3.1新模型深夜掀桌, 每秒狂飙363 token! 1/4价格暴击Claude
谷歌深夜推出Gemini 3.1 Flash-Lite,输出速度363 token/s,价格仅0.25美元/百万Token,跑分碾压GPT-5 mini和Claude 4.5 Haiku。开发者可通过Google AI Studio体验,企业用户可通过Vertex AI接入。
这个春节P图不求人!小红书开源图像编辑新SOTA
今日小红书基础模型FireRed - Image - Edit亮相,在复杂编辑指令、风格化转换等核心指标表现强,在多项权威测试达SOTA。该项目代码等已开源,模型权重将开源。团队还推出RedEdit Bench评测方案。
华为发布业界首个扩散语言模型Agent,部分场景提速8倍!
华为等团队研究发现,把Agent“底座”换成扩散式大模型(DLLM),执行速度提升30%以上,部分复杂任务效率达传统AR模型8倍。其优势源于生成范式,可重塑Agent设计。