「插件扩展」共找到 543 篇相关文章
Agent-World:扩展真实世界环境,让智能体与环境协同进化!
文章提出Agent-World,将“智能体环境探索”与“自进化训练”结合,构建了1978个环境、19822个工具。实验表明,其在23个基准上一致性优于先进方法与强开源基础模型,还分析了环境规模与自进化对性能的影响。
好上手又强大!5分钟上手Claude Code插件,保姆级教程
此为Claude Code插件保姆级教程,介绍环境选择、下载安装、登录账号等步骤,按场景讲解核心功能,还给出快捷键速查,对比插件版与命令行版优缺点,为新手和深度用户提供选择建议。
ParScale:一种全新的大模型Scaling Law
文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。
微信龙虾只活2天:一次更新干崩全生态,OpenClaw 撞上 Vibe Coding 天花板
3月22日微信官宣推出支持接入OpenClaw的ClawBot插件,两天后OpenClaw更新,将插件生态系统迁移到官方ClawHub市场,引发诸多问题,如系统崩溃、插件失效等。此次事故暴露系统脆弱性,也为Vibe Coding发展敲响警钟。
Codex 的野心,MCP 和 Skill 的下一步
作者密集使用Codex App等Agent应用,发现顶尖Agent收敛到相同界面布局。Codex野心大,要处理多格式文件、支持专业工作流。MCP和Skill未解决用户二次编辑问题,插件机制或是出路,Codex已有原始插件市场。
不改模型也能提升推理性能?ICLR投稿提出测试时扩展新范式OTV
ICLR 2026投稿论文提出单token验证(OTV),是测试时扩展新机制,让模型能边推理边判断正误。它基于并行思考思路,借助轻量内部验证器分析推理过程,实验显示其性能优于主流方法。
扩展外部测试时Scaling Law,中关村学院新发现:轻量级验证器可解锁LLM推理最优选择
文章聚焦大语言模型‘测试时扩展’,指出内部方法接近瓶颈,外部方法的传统实现有缺陷。提出 TrajSelector 策略,用轻量级打分模型复用隐状态打分,训练无需手动标注,实验显示性能增长稳定。
狂涨91.4K star!!号称是下一代Vim编辑器,体验超棒!
本文介绍开源项目Neovim,它是Vim分支,扩展性强、好用,内置终端模拟器,支持图形界面,与Vim插件兼容性好,还介绍其性能特色、安装配置方法及常用命令。
AI 智能体未来之争:是迷你应用(GPTs)?还是模块化代码(Skills)?开发者,你站哪边?
Anthropic 公布全新 Skills 功能,让开发者可通过模块化组件扩展 Claude 能力,功能覆盖网页、代码环境及 API 接口。它与 OpenAI 的 GPTs 等不同,更强调透明可审计,受开发者称赞。
“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能
在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。