「Agentic性能」共找到 4407 篇相关文章
接入 MiniMax M2.7 后,我的 OpenClaw「超进化」了
作者实测 MiniMax 新模型 M2.7,其在基准测试、代码能力、多智能体协作等方面表现出色。接入 OpenClaw 后,能高效完成复杂任务。M2.7 指令遵循率高、长上下文处理能力强且价格低,有望提升 Agent 生态表现。
OpenAI公布首颗自研推理芯片成绩,下一代已进入制造阶段
8月25日,OpenAI公布自研推理芯片Jalapeño性能测试结果,首次给出其在多款公开大模型上的具体数据。该芯片在低功耗下实现高推理吞吐量和低延迟,性能超英伟达芯片,B0版已进入制造阶段。
AI 狂潮中,电子业破局:国产先进封装加速突围
AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。
我去,真牛!Coze Studio 开源版究竟有多火?看 GitHub 最新 1.4k star 人气飙升!
Coze Studio是低代码、可视化的AI Agent开发平台,有Apache‑2.0开源许可,降低使用门槛。它能解决非专业开发者、企业等构建智能对话助手的痛点,核心功能亮点多,应用场景广,在国产AI Agent开发生态潜力大。
端侧AI从「能跑」到「会进化」,元空智能跑进惠普预装
北大出身的创业团队元空智能,提出大模型静态互联网数据红利见顶,端侧是下一轮能力跃迁核心,重新定义端侧AI为「模型×Agent×设备」,发布Boxer端侧模型与两款Agent产品,其端侧AI已拿下惠普商务电脑预装,实现规模化落地。
作为一个接过Aha单的YouTube博主,我来聊聊这个AI产品
文章指出当下AI Agent分化为通用型、生活服务型、开发者工具型和垂直行业型四类。以Aha为例,介绍其作为达人营销垂直Agent平台,在筛选达人、匹配合作、保障安全等方面的优势,还分析了适用与不适用的产品情况。
微软CPO专访:Prompt是AI时代的PRD,产品经理的工作方式已经彻底变了
微软首席产品官 Aparna 认为,Prompt 正取代传统 PRD 成构建产品起点,NLX 将成新用户体验设计范式,还解释了 Agent 核心特征。她觉得 Agent 本质是工具,未来可让其承担更多任务,产品经理关键在于「好品味」和「编辑能力」。
Anthropic封号OpenClaw之父!复刻、改价、拉黑,24天三连杀
OpenClaw创始人Peter Steinberger的Claude账号被Anthropic封号,后恢复但无官方解释。此前Anthropic改价限制OpenClaw使用,且Claude Cowork半年来对标OpenClaw核心功能。这撕开了AI平台与开源agent生态裂痕,也凸显包月模式被Agent算力需求击穿的问题。
Kimi K2.5登顶开源第一!15T数据训练秘籍公开,杨植麟剧透K3
Kimi K2.5登上Hugging Face热榜榜首,下载超5.3万。它主打Agent能力,成绩超GPT - 5.2等闭源模型,性价比高。官方技术报告公开其用15T数据训练,还搭载Agent Swarm架构,团队还剧透了Kimi K3。
同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?
编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基元律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。