「评测平台」共找到 1912 篇相关文章
你的 AI 助理一闭嘴就在「发呆」?上交大 ProAct:把 Agent 的空闲时间变成生产力
上海交通大学 APEX 实验室提出 ProAct 架构,能把对话空闲时间转化为主动准备机会。它有预测、筛选、交付三级流水线,经 ProActEval 评测效果佳,证明算力用对地方更重要,让 Agent 能提前为用户准备。
老黄呼吁所有企业「养虾」当天,阿里正规军入场,「悟空」把路铺平了
2026年初,OpenClaw火了,黄仁勋呼吁企业制定相关战略,但它存在环境依赖复杂等问题,企业不敢用。阿里发布企业级AI原生工作平台「悟空」,解决企业安全、工作流耦合和规模化等问题,被阿里重点布局。
每周产业洞察 | 从史努比交易看AI时代:手握存量IP的巨头如何开辟新路径
北京AIGC视听产业创新中心位于朝阳区东坝乡,是朝阳区推动影视制作基地建设的举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚60余家生态伙伴。首创郎园拓展服务边界,项目多地布局。
AI时代,CRM的底层逻辑正被重构|甲子光年
AI正加速改变CRM及SaaS产品形态和市场格局。纷享销客发布ShareAI平台,从连接型向智能型CRM跃迁。AI重构CRM底层逻辑,还助海外SaaS破局,中国厂商或借AI探寻商业化路径。
Pinterest 工程通过运行时感知分片将 Android CI 构建时间缩短了 36%
Pinterest 发布技术案例研究,介绍工程团队通过运行时感知的测试分片策略和内部测试平台,将 Android CI 构建时间缩短超 36%,还对比了其他公司提升 CI 性能的做法。
杜克大学、Zoom推出LiveMCP‑101:GPT‑5表现最佳但未破60%,闭源模型Token效率对数规律引关注
杜克大学与Zoom研究者推出LiveMCP - 101,这是针对真实动态环境的MCP - enabled Agent评测基准。含101个任务,实验显示先进模型成功率低于60%,研究为提升Agent能力提供改进方向。
算力产业发展重心,正在改变
2025中国算力大会落幕,我国算力产业重心从规模扩张转向应用价值。数据基础设施筑牢底座,智慧运营平台奠定普惠基础,‘应用为王’成趋势,各方行动降低用算门槛推动AI落地。
全球开源大模型,前十五名全是中国的
近日,随着新一代大语言模型更新,开源大模型成热门话题。Design Arena排行榜上,若设定为“开源”,前15名均为国产开源大模型,排名第一的是DeepSeek - R1 - 0528 ,智谱、阿里等厂商多款模型上榜。
苹果AI 路线图曝光:从未打算开发聊天机器人
苹果软件工程高级副总裁Craig Federighi在WWDC 2025表明,苹果从未打算开发聊天机器人,而是要将智能深度整合到所有平台体验中,实现环境智能,此言论引发网友热议。
中国科学家首次手搓出“球状闪电”!刘慈欣科幻小说照进现实
4月16日,中科院上海光机所团队在《自然·光子学》发文,首次在实验室可控生成具球状闪电典型特征的宏观电磁孤子。其存活时间长、空间尺寸大,还能为研究提供受控平台,有潜在应用价值。