「智能编码」共找到 3720 篇相关文章
你写的Skill,正在拖慢模型?策略式Gene才是正确答案
EvoMap团队与清华围绕‘Skill拖慢模型’问题研究,提出‘Gene’概念。经实验,Gene在控制模型表现上优于Skill,还定义了GEP协议。其成果在CritPt基准测试表现出色,为Agent经验复用提供新方向。
Zendesk:生成式 AI 让代码不再稀缺,研发瓶颈转向“吸收能力”
Zendesk 提出生成式 AI 改变软件交付核心制约因素,从编写代码转为‘吸收能力’。文章阐述该概念,提出四项应对措施,还指出 AI 对不同系统的影响,深化了编码非瓶颈的观点。
不再迷信Hackathon,把Agent推翻重做了4次!Notion负责人复盘:做AI产品如何避免“逆流而上”?
Notion负责人复盘Agent开发历程,指出AI替代的是流程。他们将模型、产品和权限接入同一框架,历经多次重构,还探讨了组织管理、评估体系、软件工厂等内容,分享对CLI和MCP的看法及产品定价策略。
放弃开源、重组权力!扎克伯格掏出Muse Spark,杀回大模型主桌
Meta在AI发展遇阻后推出Muse Spark,它是MSL首个模型,定位为通向个人超级智能的第一步,性能表现出色,当前闭源,未来Muse系列或有开源变体,标志Meta AI权力结构重塑。
让机器人学会手往哪儿伸、怎么操作,东大团队给了新解法
东南大学魏秀参团队提出 RAAP 解决具身智能领域可供性预测难题。它将 affordance 分解,设计互补推理机制,每任务仅需数十样本,已被 ICRA 2026 接收,实验显示其性能优于基线。
EvoSkills:自进化的skill,是好skill
文章分享两项Agent Skill最新研究论文,指出智能体技能从手工制作向自动进化转变。介绍EvoSkills和EvoSkill两种自动化Skill进化方案,对比其机制、验证方式等,还提及未来研究方向。
壁垒在上下文,不在模型
特赞科技发布企业级智能体系统 GEA,推出发散推理模型和企业上下文系统。指出模型能力易复制,企业上下文才是壁垒。GEA 架构分四层,有独特的推理和执行模式,已在多家企业部署。
Claude最新模型Mythos意外泄露,性能远超Opus
Anthropic内容管理系统配置失误,近3000个未发布资产泄露,Claude最新模型Mythos提前公开。它在软件编码、学术推理和网络安全等测试中远超Opus,网络安全能力尤其危险。2026年初Anthropic产品密集发布。
刚刚,全球最难考试惊天大反转!黑马AI冲破36%,顶流模型集体翻车
ARC-AGI-3测试中,顶级大模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。
阿里在海外上了个“企业级龙虾”,我用它30分钟手搓了一家网店
阿里在海外上线企业级Agent Accio Work,用户30分钟就能用它开网店。它无需部署,内置生意Skill,7x24小时帮忙选品、采购、运营等,还解决了全球电商信息壁垒、流程复杂、成本高昂等问题。