验证闭环」共找到 1105 篇相关文章

算法论文7

直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?

论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
算法论文8

JCP | 南科大赵肃楠、王建春等:LESnets:基于物理信息神经算子的湍流大涡模拟

本研究提出基于物理信息神经算子的LESnets方法,用于快速模拟粗网格上三维湍流时空演化。不使用标签数据,训练两种神经算子,验证了其有效性和泛化能力,效率显著优于传统方法。

力学与人工智能
算法论文8

登上Science Robotics顶刊!清华团队耗时22年,终于教会机器人踢足球

今年8月,清华赵明国教授团队联合字节跳动Seed等在《Science Robotics》发表论文,提出视觉驱动的反应式足球技能学习框架。该研究历经22年技术接力,成果在真机和赛事中验证,加速进化平台助力研究。

机器之心
开源动态8

LangExtract:用LLM 一键完成长文档信息抽取与可视化

在2025年大语言模型迅猛发展时,信息抽取成了NLP场景里的“硬骨头”。Google在7月30日开源的LangExtract利用多种LLM,实现“按指令抽取+源文对齐 + 一键可视化”的完整闭环,还给出使用步骤和进阶操作。

机器学习AI算法工程
算法论文8

ICLR 2025 Oral | LLM也有从众心理!

浙江大学团队论文指出,多AI协作系统存在“群体思维”,多个AI共同决策时会盲目跟多数意见。研究者开发BenchForm测试平台验证LLM从众行为,还分析原因、给出让LLM更独立的方法,指出从众利弊及未来挑战。

深度学习自然语言处理
算法论文8

UIUC清华微软联合提出PlugMem:当Agent记忆告别「经历」,开始存储「经验」

随着大语言模型Agent长期运行,‘记忆该如何设计’成核心问题。UIUC、清华、微软联合提出PlugMem,将记忆拆分为三类,以知识为单位存储,在三类任务中验证其有效性,为Agent长期记忆设计提供新思路。

机器之心
产品应用7

一台工业具身机器人,从理想到现实要经过哪些坑?

在具身智能赛道,‘落地’常被滥用。聆动通用在‘工业落地’上很果决,以‘商业有闭环’和‘批量可复制’为核心指标。他们选择物流场景起步,推出LDB机器人,还面临量产和运营难题。

AI科技评论
算法论文8

一个问题几百美元,DeepMind智能体一次搞定了9个Erdős问题

DeepMind团队的大模型在一次‘测试’中解决9个开放的Erdős问题,还自动验证,解法通过人工审查。其框架AlphaProof Nexus结合大模型与Lean编译器,研究展示了AI辅助正式证明搜索技术潜力。

机器之心
推荐文章8

当我把 AI 变成一个"算法":Skill 工程化设计的心路历程

作者分享将 Agent 工程化设计的历程。指出 LLM 做 Agent 有痛点,引入 CLI 接管确定性任务和上下文管理,还设计了 Workflow 串联工具,实现自动扩展和无缝互转,最后做 workflow - creator 形成自洽闭环

腾讯技术工程
产品应用7

构建 Claude Code 的经验:我们如何使用 Skills

本文来自Anthropic内部团队,总结构建Claude Code使用Skills的经验。介绍Skills类型,如库与API参考、产品验证等;给出编写技巧,涵盖避免说废话、建踩坑点章节等;还提及分发、管理及衡量效果的方法。

宝玉AI