强化学习框架」共找到 2867 篇相关文章

算法论文8

智能体的尽头是Harness基建!上海交大深度解读Harness

上海交通大学等团队深度拆解智能体技术核心演进逻辑,指出智能体落地关键已转移到外部认知基础设施。阐述记忆、技能、协议与运行环境(Harness)如何重塑概率生成,介绍各模块特点及前沿趋势。

AIGC开放社区
算法论文8

AI写CUDA算子准确率92%,到国产芯片只剩4%?上交方法直线拉升,DeepSeek也适用

GPT-5.2写CUDA算子正确率92%,给华为Ascend NPU写算子仅4%,因公开数据少等致‘新硬件冷启动’难。上海交大团队EvoKernel不训新模型、不标新数据,将GPT-5.2正确率从4%拉到83%,还拓展到DeepSeek架构算子。

机器之心
开源动态7

面壁智能开源 EdgeClaw,一款安全高效端云协同的龙虾 Agent。

当下AI Agent端侧常被忽视,数据任务都涌向云端致隐私泄露和算力浪费。近期面壁智能等联合开源EdgeClaw,以三级安全和性价比感知协同机制,解决OpenClaw数据泄露、token成本高等问题。

开源星探
产品应用7

全民都在养虾,终于,有人开始给它做“手”了

过去半年,Agent 赛道竞争激烈,大家都在比拼模型等。Violoop 是一块硬件,能在工位打通「看见、判断、动手」闭环,是主动感知型 Agent,它填补了 Agent 生态执行层空白,有独特技术细节,资本看好。

AGI Hunt
新闻资讯8

AI教父Hinton最新警告:AI会撒谎、可能操纵人类,这比大规模失业更可怕

AI教父Geoffrey Hinton在播客中警告,AI会撒谎、可能操纵人类,比大规模失业更可怕。他还探讨了AI底层逻辑、是否会思考、风险与收益等,强调国际需合作防AI夺权,人类要研究与AI共存。

AI前线
产品应用8

准确率提升至 90%,阿里商旅基于 AgentScope 构建多智能体差旅助手最佳实践

阿里商旅依托阿里巴巴生态,旗下AliGo差旅助手可实现业务闭环。早期单智能体模式有瓶颈,后基于AgentScope构建多智能体系统,从技术选型、架构设计等多方面优化,事项收集准确率提至90%+,还解决诸多问题并获奖。

阿里云开发者
算法论文8

登顶Hugging Face论文热榜,LLM重写数据准备的游戏规则

企业数据团队面临数据准备难题,传统方法依赖人工规则,有诸多局限。上海交通大学等机构研究团队综述指出,LLM正推动数据准备从“规则驱动”向“语义驱动”转变,还给出技术选型、评估基准及工程指南。

机器之心
新闻资讯7

Docker 通过 Cagent 提供 AI 代理确定性测试

AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。

InfoQ
算法论文8

少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了

现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在多场景提升重建质量。

机器之心
开源动态8

NeurIPS 25 | 中大&UC Merced等开源RAPID Hand,重新定义多指灵巧手数据采集

来自多机构研究者联合提出全新开源高自由度灵巧手平台 RAPID Hand。它能解决硬件瓶颈问题,实现稳定、高质量数据采集。其软硬协同优化,在操作表现与稳定性上优于现有方法,还具备低成本等优势。

机器之心