「探索增强框架」共找到 2588 篇相关文章
颠覆金融分析!多智能体AI股票分析师震撼登场!
多智能体AI股票分析师登场,由股票分析与报告撰写两智能体组成,通过CrewAI框架协作。用Streamlit构建界面,结合YFinance等获取数据,可30秒内生成含买卖建议报告。
扩大 LLM 能实现 AGI吗?
计算机科学家Stuart Russell提出继续扩大现有大型语言模型(LLM)不会导致通用人工智能(AGI)的实现。文章探讨了LLM与AGI的关系,介绍了Russell的四大AI发展预言,还呈现了网友对AI发展、AGI定义等方面的热议,指出LLM是通往更高级AI的基石而非终点。
零样本刷新三项基准:ZeroDiff++让AI边考试边学习 | TPAMI'26
本文介绍发表于IEEE TPAMI 2026的ZeroDiff++模型,是ICLR 2025 ZeroDiff的扩展工作,针对生成式零样本学习的虚假语义关联、分布脱节问题提出新框架,在三项主流基准刷新成绩
当AI幻觉开始操作电脑:深大、港科大提出ECA,让Agent行动前先验证证据
本文针对Agent场景下AI幻觉会转化为实际错误操作的问题,介绍深圳大学与香港科技大学提出的ECA框架,通过独立验证加门控检查降低不安全执行风险,给出测试数据验证方案有效性。
Agent 下半场:真正能自进化的 Agent 应该是什么样的?
当下 Work Agent 难以稳定完成复杂长程任务,且经验无法沉淀。EvoMap 提出自组织蜂群架构,通过 AutoResearch 落地验证,探索 AI4AI 方向,构建记忆和连接的三层产品结构,推动 Agent 网络自进化。
刚刚,Claude 5.1 发布!全球最强模型来了
Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1面向普通用户等,Mythos 5.1面向高风险领域伙伴。Fable 5.1性能优、价格低,在多测试中表现提升,还能用于科研,且安全防护机制升级。
2个设置,让Codex体验翻倍
文章分享两个提升Codex使用体验的技巧。一是在config.toml里添加配置,让非计划模式能主动提问;二是用特定提示词测试gpt的juice值,选正常思考程度的模型使用,提升使用心情。
刚刚开源就收藏 1000+ 收藏的 DeepSeek Harness 橙皮书,它把Harness拆解个遍!
DeepSeek Harness开源同日,《DeepSeek Harness:从开机到拆开》上线。作者花叔实测记录大量官方文档未写的细节,如完整系统提示词、出厂启动清单等,全书分四部分,获取方式简单。
藏在机器人指尖的AI底座:一家触觉公司的野心|甲子光年
本文指出机器人产业正补触觉这一课,2026年以来触觉成具身智能热门方向。但给机器人装传感器不代表其有触觉。以他山科技为例,剖析其全栈布局,探讨让机器人从物理世界获经验的路径及产业发展机会。
离开OpenAI和Google后,两位大模型核心负责人决定卷下一代架构
曾是OpenAI的「强化学习最大主义者」Jerry Tworek,与谷歌Gemini预训练负责人Rohan Anil,共同创办Core Automation。他们探讨当前AI路线问题,认为下一代架构要能持续学习,还计划打造自动化AI实验室。