「长时程Agent」共找到 3201 篇相关文章
AlphaEvolve:陶哲轩背书的知识发现 Agent,AI 正进入自我进化范式
Google今年5月发布的AI系统AlphaEvolve,结合Gemini模型与evaluator,能发现新算法。它源于FunSearch,可多领域应用,运行机制类似自然进化,其关键组件evaluator对其发展很重要,也标志AI进入自我改进范式。
伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开
开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。
打破长视频理解瓶颈:HoPE混合位置编码提升VLM长度泛化能力
如今视觉语言模型在长上下文任务表现不佳,CMU和小红书团队深入研究,首次提出多模态RoPE扩展策略理论评估框架,指出现有泛化能力不足原因,提出HoPE大幅提升VLM长度泛化能力。
开启端侧长文本时代!面壁全新架构,让小钢炮最快提升220倍
2025智源大会上,面壁智能发布MiniCPM 4.0模型,实现行业首个系统级上下文稀疏语言模型创新。它在端侧推理任务上表现出色,降低缓存需求,提高运行效能,还进行多维度架构创新,是AI领域探索高效率语言模型的里程碑。
一键式训练端到端Agent,Qwen3+MCP工具集高效集成!
RLFactory是开源的端到端RL后训练框架,将环境与RL后训练解耦,有极致易用、高效训练等特点。它让用户专注奖励逻辑和工具配置,还能提升训练效率,用Qwen3和MCP工具可快速训练DeepSearch模型。
竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500
大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在多评测中表现强,提升不靠增加token。
Cloudflare CEO 警告:未来两年,Agent 会让互联网每周爆出一个 Log4j
Cloudflare CEO Matthew Prince在播客中指出,互联网上Bot流量已超人类,未来五年或暴涨1000倍,旧商业模式将崩塌。他还谈到AI对安全、工作的影响,以及公司转型、互联网未来商业模式等问题。
世界模型来了因果技术标杆!具身大脑真要长脑子了
具身智能有泛化能力瓶颈,构建‘世界模型’成热门赛道。Aether AI获2000万美元种子轮融资,走因果世界模型路线,创始人黄碧薇认为这是世界模型‘终局形态’,能让机器人理解物理规律。
Demis Hassabis:AGI 还缺什么,智能体到底行不行,下一个科学突破长什么样
Google DeepMind CEO Demis Hassabis 做客直播,探讨当前 AI 范式距 AGI 差距、智能体水平、科学突破模式等话题。指出当前范式或需关键突破,记忆方案待优化,AlphaGo 技术复活,还给出创业建议。
YC总裁开源个人AI记忆系统GBrain:让你的OpenClaw/Hermes长脑子
YC总裁Garry Tan开源GBrain,这是经实战检验的AI记忆中枢。它有真实数据规模、混合搜索架构等特点,核心工作流含实体检测等。技术选型有考量,还提供体验方式和技能包文档。