「有意识的AI」共找到 13975 篇相关文章
红杉中国推出 Agent 基准测试「xbench」,双轨评估体系,关注 AI 真实场景的效用
红杉中国开放AI和Agent基准测试工具「xbench」,采用双轨评估体系,构建多维度测评数据集。首期发布两个核心评估集并排名,提出垂类Agent评测方法论。该工具旨在解决现有评估问题,关注AI真实场景效用。
AI 智能体实践评估:基准、框架与经验总结
文章为将 AI 智能体从原型落地到生产环境的团队提供实用评估框架。指出传统评估不适用于智能体,介绍评估工具,阐述五大评估支柱,还给出基于 Claude 和 LangChain 的评估示例及实践经验。
盘点16个把自己蒸馏成Skills的国民级App。
作者盘点16个将自身能力封装成Skill或MCP的国民级App,涉及餐饮、出行、办公等领域,如瑞幸咖啡、飞猪、飞书等,还提到部分AI产品集成第三方服务情况,指出向全面Agent化过渡的趋势。
鹅厂员工都用AI Coding捅过多少篓子?
本文盘点AI Coding翻车现场及防坑指南,10位鹅厂同事分享用AI Coding捅过的篓子和防坑技巧,如选好模型、手动拆解任务、提前备份、限制危险操作等。
一句话生成可上线的动效,这个项目真不错!
Github上的`Text-to-lottie`是开源Skill框架,可让Claude Code或Codex当动效设计师,按Lottie规范生成标准`lottie.json`。它有Coding Agent直出Lottie JSON、内置预览播放器等特色,助开发者快速产出合规Lottie资产。
XcodeBuildMCP:让 AI 像开发网页一样搞定 iOS/macOS 应用
Sentry开源的XcodeBuildMCP项目,打破传统AI辅助开发手动验证循环,通过MCP和CLI让AI代理操作Xcode构建系统,实现自动化开发流程。它配置简单,能覆盖日常开发需求,助力iOS开发迈向‘无人值守’。
OpenAI盯上苹果开发者生态,吞了家AI编程公司
OpenAI收购AI编程初创公司Alex,其产品是苹果Xcode量身定制版Cursor,集成智能助手到Xcode。此前OpenAI宣布GPT - 5内置于Xcode 26,收购或为与Anthropic竞争。
大模型狂叠 buff、Agent乱战,2025大洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?
InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨大模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了大模型、Agent、AI Native等发展趋势。
谷歌发布首个AI+教育RCT实验,传统教材要凉?
谷歌论文提出Learn Your Way AI增强型教科书系统,有两阶段AI生成框架,构建完整学习体验。经专家评审和RCT证明,使用该系统的学生学习效果和体验更好,还介绍了其可用场景。
复盘 AI 陪伴消亡史:我们究竟做错了什么?
文章复盘了 AI 陪伴从高光到转折的历程,分析用户需求从猎奇到追求深层情感交互的演变,探讨产品设计迭代,指出用户体验不佳、厂商未实现 PMF 等问题,也提及市场积极信号,对未来发展持观望态度。