「与爱为舞」共找到 9370 篇相关文章

产品应用8

Anthropic 今天发了一个新产品,可能会让一批做 AI 智能体基础设施的团队失业

Anthropic 发布新产品 Claude Managed Agents,基础设施全包按用量收费。其年经常性收入破 300 亿美元。该产品与 Claude Code 有别,能解决企业痛点,已有不少企业使用,也存在局限性。

宝玉AI
开源动态7

AI Agents的DeepSeek顿悟时刻:AutoHarness

文章介绍开源项目「Aha」— AutoHarness,这是面向AI Agent的自动化Harness Engineering轻量级治理框架,能让智能体迎来顿悟时刻。对比了其与LangGraph、OpenAI SDK能力,还给出核心架构、安装及使用示例。

PaperAgent
算法论文8

微软OEL框架:大模型一次部署,终身进化

微软最新论文Online Experiential Learning (OEL)提出让LLM在真实部署后持续自我进化的框架,无需人工标注等。介绍了在线体验学习的必要性、OEL方法论及实验验证,揭示关键洞察与启示。

PaperAgent
新闻资讯7

叫板华尔街之神!诺奖得主在谷歌眼皮底下组队炒股,CEO亲自叫停

AlphaGo之父Hassabis曾在谷歌眼皮底下拉20个顶尖研究员训练高频交易AI,想挑战华尔街量化之神,与贝莱德探讨合作。后因谷歌CEO叫停,项目停摆。不过如今AI+金融正加速发展。

新智元
算法论文8

首个用户生活「长程模拟器」来了!LifeSim 重新定义大模型个性化评测

现有个性化助手评测基准与真实用户-助手交互脱节,来自复旦大学等的研究人员提出 LifeSim 框架及 LifeSim-Eval 评测方法。实验显示主流 LLM 处理显性需求尚可,隐性意图识别等方面短板明显。

机器之心
新闻资讯7

刚刚,全球最难考试惊天大反转!黑马AI冲破36%,顶流模型集体翻车

ARC-AGI-3测试中,顶级大模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元
开源动态7

1.9万行 Claude Code“AI垃圾”杀入 Node.js:全球顶流开源项目,快守不住了

2026 年 1 月,Node.js 技术指导委员会成员 Matteo Collina 用 Claude Code 生成近 1.9 万行代码提交 PR,引发争议。长期贡献者 Fedor Indutny 质疑其不符合 DCO 1.1 条款,而 Collina 认为自己担责,且开源生态已认可 AI 辅助贡献。

InfoQ
算法论文8

Hyperagents:AI学会如何自我改进

近日,Meta发布Hyperagents论文引关注。它尝试解决AI能否自我改进改进方式的问题,核心创新是‘元认知自我修改’,实验在多领域表现出色,还涌现元级别改进且能跨领域转移,但有安全风险。

AI工程化
新闻资讯8

坚决抵制!CCF亮最狠一招,AI顶会NeurIPS新规或自掘坟墓

AI顶会NeurIPS 2026手册新增条款,限制部分国内机构研究人员评审、投稿。中国计算机学会CCF发起反制,倡议科研人员拒绝为其服务和投稿,若不改正将移出推荐目录,或重创该会议。

新智元
开源动态8

狂揽 11.8K Star!用大厂 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!

GitHub上名为PUA的项目狂揽11.8K Star,作者用大厂PUA话术‘驯化’AI,总结了AI的‘五大摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。

开源星探