「Agent 2.0」共找到 4702 篇相关文章
Anthropic 的 Harness 设计:build to delete
Anthropic工程博客发布Harness设计文章,探讨Claude完成全栈应用开发任务。指出单Agent模式问题,采用GAN式对抗、三Agent编排,对比单Agent与多智能体产出,还介绍调教评估者及编排简化,提出Build to Delete原则。
造过 Codex 的人,为什么每天用 Claude Code
Calvin曾带队构建编程Agent Codex,如今日常用Claude Code。他和Garry Tan在播客聊了编程Agent的产品哲学差异、分发逻辑等。Claude Code拆分上下文表现出色,LLM成开发者工具推荐引擎,还探讨了构建、使用编程Agent的要点。
独家对话极映科技高鑫:我们为什么要做一个比Sora难10倍的物理世界模型?|甲子光年
本文是对极映科技创始人高鑫的独家专访。极映源于高鑫早年体验,团队具深厚经验。其模型回归底层定律,响应快。投资人看好,专家认为能解决痛点。高鑫谈技术、前景、商业化等,称有望引领物理仿真变革。
比 Playwright 更给力,这个新开源的项目6啊~
GitHub上的BrowserAct项目是面向AI Agent的浏览器自动化CLI,是为AI Agent设计的真实浏览器执行层。它有三层反检测突破体系、三种浏览器模式等功能,能解决Agent操作浏览器的诸多问题,适合多场景。
DeepSeek Harness规模化踩坑实录:耗时、成本、失败到底该怎么查
Agent 进入日常研发流程后,使用方关注耗时、Token 消耗和失败回溯。DeepSeek Harness(DSH)是开源 Agent 框架,腾讯云 Agent 可观测提供 DSH 采集插件,构成全景可观测方案,还介绍接入实践与其他能力。
WRC整理床铺机器人背后模型曝光!端到端双系统全身智能VLA,仅凭少量微调就能get任务
星海图在2025WRC展示G0模型,可让机器人自主完成铺床任务。其发布端到端双系统全身智能VLA模型G0,结合真机数据集与架构,还构建开放数据集,评测结果优于π0模型,即将开源。
谁为 Data Agent “买单”?
Kyligence联合创始人李扬围绕AI数据智能体服务对象及带来的转变分享思考。它能解决领导数据客观性、时效性等问题,也助分析师深入研究,最大价值是让业务人员从0到1用上数据,推动企业数智化转型。
Claude 通过率不到 4%,SaaS-Bench 撕碎了 Computer-Use 的「全自动办公」幻想
UniPat AI用SaaS - Bench测试,让Agent在真实工作环境中执行任务。结果显示,Claude Opus 4.7端到端完全通过分数仅3.8%,多数模型表现差,还暴露Agent四种致命缺陷,揭示其与真实工作能力有巨大鸿沟。
对话智源王仲远:机器人的大小脑可能会“合体”,但不是今天
今年智源大会上,智源研究院推出“悟界”系列大模型,如Emu3、Brainμ、RoboOS2.0、RoboBrain2.0和OpenComplex2。智源研究院长王仲远称大模型技术未到尽头,介绍了模型特点及发展趋势,如机器人大小脑融合需时间。
有生之年吃到了钉钉的细糠
作者参加“2025 钉钉十周年暨新品发布会”,体验了钉钉 8.0 版本。该版本开启 AI 1.0 新篇章,界面焕然一新,以钉钉 One、AI 搜问等重塑工作流程,还升级语音智能硬件,实现信息处理闭环,提升企业与员工效率。