自闭环验证」共找到 2074 篇相关文章

开源动态8

如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证

大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证

深度学习自然语言处理
新闻资讯8

OpenAI公布首颗研推理芯片成绩,下一代已进入制造阶段

8月25日,OpenAI公布研推理芯片Jalapeño性能测试结果,首次给出其在多款公开大模型上的具体数据。该芯片在低功耗下实现高推理吞吐量和低延迟,性能超英伟达芯片,B0版已进入制造阶段。

DeepTech深科技
算法论文8

LLM 仅靠身就能增强推理?SePT 给出简洁在线训练范式

多数推理后训练方法依赖外部信号,SePT仅用模型身生成的答案训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。

机器之心
新闻资讯7

独家|清华团队组团创业,押注机器人端侧进化,已完成首轮融资

过去一个多月,机器人学习风向生变。清华李健雄团队围绕机器人学习等研究多年后成立本溯智能创业。他们认为当下主流技术路线有问题,押注In - Context Learning,让机器人端侧进化,降低部署成本。

DeepTech深科技
算法论文8

比Transformer更强的架构来了?浙大新作Translution,一统卷积和注意力

随着大模型发展遇瓶颈,浙大等校学者提出神经网络基础操作Translution,实现注意力与卷积的融合统一,构建更普适神经计算机制。它性能超Self - attention,为新一代神经网络发展开辟新方向。

新智元
算法论文8

从物竞天择到智能进化,首篇进化智能体综述的ASI之路

普林斯顿大学等机构研究者发布首个进化智能体综述,为领域建统一理论框架和路线图。综述给出形式化定义,围绕What、When、How、Where构建分析设计框架,还探讨评估范式并指明未来方向。

机器之心
算法论文8

别等GPT-5了!普林斯顿万字综述揭秘:我们要做进化Agents!

普林斯顿大学联合多顶尖机构发表“进化智能体”综述,描绘AI从静态工具演变成我学习迭代智能体的过程,拆解其进化核心维度,介绍触发进化机制的时机、修炼方式及应用方向。

探索AGI
产品应用7

OpenClaw 引爆 AI 安全焦虑,Armadin 的 Agent 攻防闭环会成为新范式吗?

OpenClaw走红使agent主执行任务能力受关注,也带来网络安全风险。传统安全体系难应对,Google高价收购云安全公司释放信号。Armadin构建agent swarm系统形成主防御闭环,介绍其理念、产品、案例及面临的技术挑战。

海外独角兽
推荐文章8

Loop Engineering 实战:实现从日志扫描到预发部署的全闭环

文章分享 Loop Engineering 实战经验,指出传统维护循环存在看不见、记不住、没闭环问题。介绍了从 Prompt 到 Loop 的四代 AI 工程化范式,阐述 Loop 原理、组件及落地实践,还提及范式迁移和踩坑教训。

阿里云开发者
产品应用8

Claude一夜爆更修bug,PR己绿了!全球程序员:「摸鱼」正式合法

Claude Code上线「云端动修复」功能,可动跟进PR,排查问题、写代码并推送,解放开发者双手。同时,科研团队用其打造Claudini,迭代56次发现新型越狱算法,Claude Code还能进化写代码。

新智元