「AI应用编排」共找到 10544 篇相关文章
什么都不做就能得分?智能体基准测试出现大问题
随着AI智能体走向实际应用,其基准测试变得至关重要。但现有基准测试问题多,如WebArena判错答案、τ - bench给无操作智能体高正确率。文章提出有效性判据和ABC清单,还揭示主流基准测试诸多问题。
一文讲懂Agent及其主流框架:自己想、自己干、自己复盘的才是好Agent!
文章对比Workflow和Agent,指出复杂多变场景下Agent框架更适用。还介绍AutoGPT、LangGraph等5款主流Agent框架,涵盖其特点、应用场景等,最后提及腾讯云TDAI团队探索数据库与AI结合。
赌自己会失业!田渊栋八人天团狂揽44亿元,杀入「递归进化」赛道
Recursive Superintelligence由八位顶尖AI研究员创立,获GV、英伟达等投资6.5亿美元。他们要让AI自我训练,实现递归自我进化,若成功或使AI研究员岗位消失。此前已有相关成果,产品端Anthropic也在推进AI主动性。
“Skills 不就是脚本套个壳吗?我十几年前就玩 AutoIt 了”
程序员常认为 Agent Skills 是脚本换壳,实则二者有本质差异。脚本按步执行,Skills 由 AI Agent 调度、用自然语言编排工作流。确定的事用代码,不确定的交给 Agent。Skills 降低成本、利于分享,进化快但有安全问题。
大模型的进化方向:Words to Worlds | 对话商汤林达华
量子位对话商汤林达华,探讨大模型发展。商汤的SenseNova - SI超越李飞飞团队模型,林达华认为单纯依赖参数规模的AI范式遇瓶颈,商汤推出NEO架构革新,还在落地应用优化,为年轻人指明新赛道。
DeepSeek低价风暴打服硅谷!海外平台争相倒贴V4 Flash
DeepSeek V4 Flash掀起价格风暴,全球开发者为之疯狂。海外平台如Nous Portal、Cline等纷纷补贴,其能力大幅提升,价格却极低,让开发者更愿尝试开源模型,AI应用层或迎转机,且DeepSeek Code可能将至。
Auto Research时代,47个没有标准答案的任务成了Agent能力必测榜
Einsia AI旗下Navers lab发布Agent Benchmark——Frontier-Eng Bench,让AI在47个多学科交叉的硬核任务中做工程优化,测试其迭代优化能力。研究总结出AI进化规律,初步勾勒接近真实工程循环的AI系统。
英伟达GPU,将沦为白菜价
硅谷投资大佬Peter Thiel称AI芯片最终会成白菜价。当前英伟达靠垄断赚大钱,但AMD、ASIC、TPU、Trainium等正围剿它,利润将从硬件层转移到应用层,英伟达可能慢慢走下坡路。
谷歌最新版「深度研究」反击GPT-5.2
GPT - 5.2发布前,谷歌推出新版Gemini Deep Research Agent,基于Gemini 3 Pro构建,功能强大。还开源DeepSearchQA,推出交互API。此外,DeepMind与英国政府合作,在城市规划、科学研究、网络安全等多领域应用AI技术。
亿级日活App的“算力生死劫”:推理成本倒挂,他们靠跨云架构砍掉75% GPU集群
一家AI穿搭+购物推荐的出海应用DAU破亿,但算力和传输成本高,ARPU远低于成本。该企业转向Akamai推理云,换用RTX PRO 6000,缩减服务器集群,降低成本,采用跨云架构过渡,实现零阵痛平替。