超体」共找到 3438 篇相关文章

算法论文7

700多个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI自曝黑料

Anthropic故意训练近700个「有问题」模型,训了LoRA适配器(IA)让模型自报家门。IA在AuditBench平均成功率59%,但也存在幻觉、成本高、训练分布无指南等局限。

新智元
算法论文8

让大模型自己写代码、自己进化,GIM和港大这篇ACL主会,把量化因子挖掘重做了一遍

香港大学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能探索系,让大模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。

机器之心
开源动态8

openJiuwen社区首发Team Skills,定义Coordination Engineering新范式

文章围绕多智能系统协作问题,指出传统任务编排方式的局限。华为JiuwenClaw团队发布Coordination Engineering新范式,通过Agent Team、Team Skills等能力,解决团队组建、技能沉淀、复用及进化等问题,并以旅行规划为例展示实战效果。

InfoQ
开源动态8

AI编程代理的「插件时代」来了:一个程序员的.claude目录,一天涨了5500星

过去一周,GitHub Trending半数项目围绕AI编程代理做‘技能扩展’。如Matt Pocock开源`.claude`目录配置文件,一天获5500星。多个同方向项目涌现,标志AI编程工具竞争焦点转向生态。

AI Reading Hub
产品应用7

不再迷信Hackathon,把Agent推翻重做了4次!Notion负责人复盘:做AI产品如何避免“逆流而上”?

Notion负责人复盘Agent开发历程,指出AI替代的是流程。他们将模型、产品和权限接入同一框架,历经多次重构,还探讨了组织管理、评估系、软件工厂等内容,分享对CLI和MCP的看法及产品定价策略。

AI科技大本营
新闻资讯7

神秘模型屠榜多日、碾压Seedance 2.0!背后竟是阿里大招:新部门首作实锤,引爆股价拉升

近日,神秘模型 HappyHorse-1.0 登顶 Artificial Analysis 视频模型排行榜。4 月 10 日,阿里确认它是 ATH - AI 创新事业部自研产品,正在内测。该模型技术亮点多,若开源或使 AI 视频行业格局生变。

AI前线
算法论文8

EvoSkills:自进化的skill,是好skill

文章分享两项Agent Skill最新研究论文,指出智能技能从手工制作向自动进化转变。介绍EvoSkills和EvoSkill两种自动化Skill进化方案,对比其机制、验证方式等,还提及未来研究方向。

PaperAgent
推荐文章7

一文搞懂 Coding Agent 和 Harness

文章介绍编码智能和 Agent harnesses 设计,阐述 LLM、推理模型与 Agent 关系,指出 harness 是让 LLM 在特定任务更好用的关键。还详细讲解 Coding harness 六个核心组件,并对比了 OpenClaw。

特工宇宙
新闻资讯8

Anthropic史诗级泄密!全新模型意外曝光:能力碾压Opus 4.6,因太危险被限制发布

Anthropic重大泄密,全新模型“克劳德神话”(Claude Mythos)及Capybara层级曝光。新模型性能Claude Opus 4.6,但因网络安全隐患大未全面发布,首批仅给安全机构。泄密源于配置失误。

AI寒武纪
新闻资讯7

刚刚,全球最难考试惊天大反转!黑马AI冲破36%,顶流模型集翻车

ARC-AGI-3测试中,顶级大模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元