混合训练框架」共找到 3570 篇相关文章

算法论文8

LaPha:你的Agent轨迹其实嵌入在一个Poincaré球?

经典强化学习动作空间离散有限,但语言模型动作空间几乎无限。上海科学智能研究院联合复旦大学提出LaPha,将智能体行为树映射到潜空间,构造密集奖励、剪枝等,在基准测试中效果显著。

机器之心
产品应用7

OpenClaw 引爆 AI 安全焦虑,Armadin 的 Agent 攻防闭环会成为新范式吗?

OpenClaw走红使agent自主执行任务能力受关注,也带来网络安全风险。传统安全体系难应对,Google高价收购云安全公司释放信号。Armadin构建agent swarm系统形成自主防御闭环,介绍其理念、产品、案例及面临的技术挑战。

海外独角兽
算法论文8

登顶Hugging Face论文热榜,LLM重写数据准备的游戏规则

企业数据团队面临数据准备难题,传统方法依赖人工规则,有诸多局限。上海交通大学等机构研究团队综述指出,LLM正推动数据准备从“规则驱动”向“语义驱动”转变,还给出技术选型、评估基准及工程指南。

机器之心
产品应用8

Clawdbot 如何搭建永久记忆管理系统:全靠 MD 文档

AI研究工程师Manthan Gupta复盘Clawdbot记忆机制,其记忆用MD文档存档,有双层记忆系统。系统有独特管理方式,如压缩、记忆刷新等,坚持透明度、搜索、持久性、混合等原则。

Founder Park
新闻资讯7

Docker 通过 Cagent 提供 AI 代理确定性测试

AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。

InfoQ
算法论文8

o1之后下一个范式?隐式CoT大突破,让推理不再「碎碎念」

文章推荐 Implicit Chain-of-Thought 的最新进展 SIM-CoT,它直击隐式 CoT 核心痛点,用辅助解码器让隐式推理可解释。推理零额外开销,效果猛,研究已中稿 ICLR 2026,论文等均已开源。

机器之心
算法论文8

4D通用世界模型!中科院NeoVerse用百万单目视频直接构建

中国科学院自动化研究所与CreateAI团队构建4D世界模型NeoVerse,它用全新端到端架构,从单目视频高效重建4D高斯泼溅,模拟成像退化提升生成鲁棒性,在多任务表现卓越。

AIGC开放社区
开源动态8

RDSAI-CLI - 用AI重塑数据库终端CLI体验

阿里云RDS团队在发布「RDS AI助手」后,推出智能终端工具RDSAI-CLI。它融合大语言模型能力,将数据库命令行操作升级为意图式交互。该工具已开源,有基础与高级功能,未来还会持续优化。

阿里云开发者
新闻资讯7

突发!OpenAI大神姚顺雨,任腾讯首席AI科学家

OpenAI科学家姚顺雨入职腾讯,任首席AI科学家,兼AI Infra部、大语言模型部负责人。他是清华姚班学霸,研究智能体成果多,还曾提出AI进入‘下半场’,评测将更重要的观点。

新智元
算法论文8

田渊栋离职Meta,最后一篇论文?

离职Meta后,田渊栋团队论文被NeurIPS 2025录用。研究提出「三门理论」,发现RLVR微调在小权重发力,不破坏模型结构,还绘制出RLVR训练动态的「参数层面全景图」。

新智元