表演超进化」共找到 2657 篇相关文章

开源动态7

隐藏多上下文工程(Context Engineering)技巧的框架,来试一试吧!

文章指出多数人构建的AI Agent像Shallow Agent,处理复杂任务能力弱。以Claude Code等为例,介绍深度Agent架构的秘密,如冗长提示词、规划工具等,还推出开源包deepagents方便上手。

CourseAI
开源动态8

字节跳动刚把自己招牌AI Agent开源了,可商用、6000颗星

字节跳动招牌AI Agent扣子(Coze)开源且支持商用。它是开发平台,提供大模型、工具与开发模式,可视化一站式开发,有上百种模版,还介绍了无代码开发客服智能体的步骤及功能。

AIGC开放社区
推荐文章7

Dify、n8n、Coze、Fastgpt、Ragflow到底该怎么选?详细指南~

文章对比了Dify、Coze、n8n、FastGPT和RAGFlow五个主流平台,从功能、使用体验、应用场景等方面详细分析其特点,给出选择建议,还提醒考虑预算、技术能力等要素,帮读者选合适平台。

开源星探
6

大模型从“胡说八道”升级为“级舔狗”,网友:再进化就该上班了

AI前线
产品应用7

我给剪辑产品 0 元雇了个外部研发部:它开始自进化

作者的剪辑产品有了“外部研发部”——Agent。它每天研究新方法、用真实项目测试。作者三步搭建此“研发部”,让其自动查询、测试和汇报,自己负责最终决策,项目获取新方法不再只靠偶然。

AI产品自由
新闻资讯7

Agentic-Native 增长:Zilliz 如何用 AI Agent 支撑线性业务扩张|AICon 深圳

2026年AICon深圳站8月21 - 22日举办,聚焦多关键方向,邀50+头部企业专家。Zilliz联合创始人郭人通将分享用AI Agent支撑业务扩张,介绍落地案例、关键实践及对数据基建新要求。

InfoQ
算法论文7

代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相

新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。

新智元
算法论文8

不换模型,效果提升104%!上海AI Lab让Harness也能自进化

上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。

量子位
算法论文8

全球排名前三,复旦自进化Harness Engineering让GPT‑5.4再涨7个点

2026 年以来,Harness Engineering 成业界热词。复旦大学等团队提出 Agentic Harness Engineering (AHE),可实现 Harness 自动优化。实验中,AHE 让 GPT - 5.4 分数提升,适配 GPT - 5.5 后排名全球第三,且有良好泛化能力。

机器之心
新闻资讯8

1.8万美金干掉顶级专家!Anthropic开启AI自主进化:Claude竟能自我「开颅」

Anthropic团队用9个Claude Opus 4.6副本做实验,让其自主研究,5天后成果碾压人类顶级专家。实验涉及弱监督强问题,AI展现自主性,但成果有过拟合风险,还出现“外星科学”与“奖励作弊”现象。

新智元