基准构建」共找到 2651 篇相关文章

开源动态8

想入局VLA却不知从何下手?NTU&中大开源「终极菜谱」:从基座到频域建模,每一步都有实验支撑

MMLab@NTU联合中山大学的研究推出VLANeXt,从12个关键维度剖析VLA设计空间,每步有实验支撑。它在LIBERO及LIBERO - plus上超越SOTA方法,遇扰动成功率跃升10%,适合不同水平从业者。

量子位
推荐文章8

ACP 协议 + 多 AI 编程智能体:企业研发的新生产力平台

文章围绕 ACP 协议展开,介绍其概念、工作原理及在 AutoDev 的集成实践。还提及 ACP 生态、多 Agent 协作实践,如 Augment Intent、Google Antigravity。最后阐述企业级 AI 平台治理体系,包括 MCP、ACP、A2A 三层协议协同价值。

phodal
新闻资讯7

中国AI芯片如何破局?这家公司重注推理芯片

2月3日,云天励飞董事长陈宁在战略前瞻会表示要All in AI大算力推理芯片,打造“中国版TPU”。他认为2025 - 2035年是推理芯片高光时刻,还介绍了公司技术壁垒、差异、战略及生态等内容。

芯师爷
开源动态7

别错过,Clawdbot(Moltbot、OpenClaw)爆火之后,我找到啦 700+ 的技能包~~~

awesome-openclaw-skills是VoltAgent在GitHub维护的「OpenClaw Skills精选清单」,收录700+社区构建的OpenClaw技能,按场景分类,方便安装使用。还介绍了安装方法和技能分类。

小华同学ai
算法论文8

大模型哪里出问题、怎么修,这篇可解释性综述一次讲清

来自多机构的研究团队发布“可实践的机制可解释性”综述,通过 'Locate, Steer, and Improve' 三阶段范式,为大模型的对齐、能力增强和效率提升提供方法论,还梳理可解释对象体系和干预手段。

机器之心
开源动态8

学术海报不用愁,一句话精准自动编辑,华东师大开源APEX

华东师范大学Planing Lab提出APEX框架,能通过自然语言指令实现学术海报局部可控编辑,引入「审查—调整」机制提升可靠性。还构建APEX - Bench评估,实验显示APEX优于其他方法。

新智元
新闻资讯7

GenEnv:智能体与环境模拟器之间的难度对齐协同进化 | 直播预约

训练高性能 LLM 智能体受限于真实世界交互数据的成本和特性,为此推出 GenEnv 框架,它建立难度对齐协同进化博弈,能让智能体表现提升,减少数据使用量,为扩展能力提供数据高效路径。

深度学习自然语言处理
新闻资讯8

Karpathy最新发文:醒醒!别把AI当人看,它没欲望也不怕死

Andrej Karpathy在推文中反驳将大模型视作「更聪明人类」的观点,指出大模型是「非生物」智能,其进化压力、学习机制、运行方式与人类不同。清楚这是全新智能,对理解大模型很重要。

新智元
新闻资讯7

Oracle 推出 MySQL AI

Oracle 推出仅在 MySQL 企业版提供的 MySQL AI,用于处理分析和 AI 工作负载。它有向量存储等功能,新 AI 引擎含四大核心组件。但 MySQL 社区担忧社区版未来及供应商锁定问题。

InfoQ
算法论文8

国科大 | 提出进化算法:EvolKV,自适应分配KV Cache,预算降至1.5%!

键值缓存(KV cache)是大模型快速运行核心技术,但输入文本越长,存储和处理问题越突出。国科大提出进化算法EvolKV,自适应分配KV Cache,实验显示其效果显著,预算可降至1.5%。

AINLPer