「自主实验」共找到 1784 篇相关文章
刚刚,OpenAI发布CoT监控,增强AI Agent自主能力
今天凌晨,OpenAI发布思维链(CoT)监控技术论文,用于监督AI Agent,增强其自主性。思维链监控可调试故障、合规审计,是构建安全透明AI的蓝图,文中还提及CoT监控必要性及有效方法。
大突破!实验证明,RL能为LLM注入“创新”能力
此研究挑战‘RL不教新技能’观点,通过‘字符串转换预测’实验证明,RL能让LLM学会组合已有原子技能,形成可泛化、迁移的元技能,还给出模型能力提升路径。
NVIDIA团队让编程Agent接管真实机器人实验,成功率达99%
NVIDIA GEAR 实验室负责人介绍 ENPIRE 项目,首次在机器人硬件实现自动化研究。让 8 个 Codex Agent 驱动闭环,完成高精度任务,成功率 99%。项目计划开源,还提出 MRU 与 MTU 指标。
Claude Sonnet 4.5 发布,30 小时自主编码刷新行业纪录
Anthropic发布Claude Sonnet 4.5,号称最强编程模型,自主编码达30小时。它性能超GPT-5等,Claude Code升级,文件处理、API能力增强,价格不变,多平台集成,还通过白盒审计提升安全性。
AI是「天才」还是「话术大师」?Anthropic颠覆性实验,终揭答案!
Anthropic新研究证实Claude模型有一定内省意识,能控制自身内部状态。用「概念注入」实验,Claude Opus 4和4.1表现最佳。不过该能力不可靠、局限大,未来进化情况待察。
生产级Prompt自动化推理评估A/B实验结果的工程实践
本文围绕生产级Prompt自动化推理评估A/B实验结果展开,介绍系统背景与痛点,展示主Prompt和决策树,用deepseek - r1等模型推理。通过分析Bad Cases优化Prompt,总结设计原则和迭代方法,还给出通用启示与展望。
创智突破:AI首次自主发现106个超越人类设计的神经网络架构
创智学院团队发布的AI超智能系统ASI - ARCH,自主发现106个超越人类设计的神经网络架构,建立“科学发现缩放定律”,实现从“自动化优化”到“自动化创新”转变,还将成果开源推动研究发展。
如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程
丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。
已量产交付!芯桥半导体全栈国产GPU助推智算自主化
芯桥(北京)半导体成立于2025年3月,掌握核心自主知识产权,旗下Sinexus X200及Sinexus S200已量产,产品在多算力集群点亮。X200性能强、价格优,芯桥还提供全栈式解决方案。
跨会话不再「失忆」:openJiuwen社区开源 AutoGenetic Memory,让Agent记忆自主生长
华为openJiuwen社区开源AutoGenetic Memory,让Agent记忆自主生长。它有分层记忆体系、Auto Dreaming等设计,能提升记忆准确率,降低Token消耗,让记忆从被动存储变为可治理、共享和自我演化的核心资产。