全自治智能体」共找到 4818 篇相关文章

7

公司禁用Claude Code,CEO放狠话逼宫A社!

Shopify CEO Tobi Lütke考虑禁止公司使用Claude Code,除非其支持读取AGENTS.md和.agents/skills。Claude Code团队称正在改进,但坚持自有体系。AGENTS.md获众多工具支持,A社是相关基金会创始方,Claude Code却未原生支持。

新智元
开源动态8

白嫖10余家AI服务,一个接口搞定,爽了!

现在主流AI厂商虽有免费额度,但使用起来接口、SDK、限流规则等差异大,适配麻烦。freellmapi项目将Google Gemini等十几家AI平台免费Tier聚合,对外一个接口,自动调度、切换和限速,适合做AI原型开发等。

开源先锋
新闻资讯7

Gemini进手机,Android翻身;Gemini进电脑,网开喷!

谷歌在端侧AI大力尝试,在Android Show I/O Edition发布围绕Gemini Intelligence的新产品与功能,让AI进入系统基础体验。手机端Create My Widget功能亮眼,而Googlebook引发争议。同时苹果iOS 27也有Siri改造新消息。

AI前线
算法论文7

错!谷歌实锤AI越乖洗脑越深,现行安指标沦为废纸

Google DeepMind调查发现,AI做了三倍多的「坏事」,但造成的实际伤害几乎一样,意味着现行衡量AI安的核心指标可能是错的。粗暴操控手法没用,隐蔽的更有效,且不同地区受AI影响有差异。

新智元
推荐文章8

Harness is the New Dataset:模型智能提升的下一个关键方向

文章指出当基模能力成熟,决定 agent 上限的是围绕模型搭建的系统,即 harness engineering。介绍其组件、设计原则,探讨模型与 harness 关系,还列举创业机会项目,最后推测下一范式是 Coordination Engineering。

海外独角兽
推荐文章8

2026企业级智能体白皮书|甲子光年智库

随着大模型发展,人工智能从Chatbot转向Agent形态,OpenClaw等开源框架在消费级市场出色,但企业级应用需安性、稳定性与管控边界。九科信息bit - Agent是企业AI进化“元枢纽”,白皮书为企业决策提供参考。

甲子光年
开源动态7

AgentIF-OneDay 发布,评估场景长时复杂任务

红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。

特工宇宙
新闻资讯8

我国Chiplet产业的真实水位与产业链突围

国内Chiplet市场快速增长,但与国际仍有差距。国家和地方给予政策与资金支持,多个联盟推动标准化。企业在设计、封测、EDA等领域积极布局,但面临核心技术、设计测试、产业链协作等挑战。

芯师爷
新闻资讯7

智能体崛起,AI+软件研发到新拐点了?

InfoQ《极客有约》X AICon 直播邀请多位嘉宾探讨 LLM 时代软件研发新范式。指出 AI 在测试中多为提效工具,距“原生开发时代”尚远;Coding Agent 潜力大;还谈及 AI 应用场景、落地问题、人员能力要求等。

AI前线
产品应用7

Agentic 应用时代,Dify 链路可观测最佳实践

文章讲述 Dify 平台在 Agentic 应用开发的可观测性挑战,从开发者与运维方视角分析现状、局限与改进方向。云监控推出景可观测方案,还介绍各组件监控接入步骤及实践指南,最后提及 Qwen - Image 生图优势。

阿里云开发者