「全平台应用」共找到 4652 篇相关文章
全国首部AI智能体应用评估标准,现公开征集起草单位和个人!
2025年成AI智能体元年,市场规模爆发式增长,但企业部署面临‘效能黑箱’。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,现公开征集起草单位和个人。
Gemini 2.5 Pro 负责人:最强百万上下文,做好了能解锁很多应用场景
谷歌DeepMind长上下文预训练联合负责人Nikolay Savinov在播客中分享Gemini 2.5长上下文技术。他认为长上下文能革新产品交互,与RAG协同,未来千万级token上下文将成标配,但当前百万级未达完美时扩规模意义不大。
GPT-4o连验证码都解不了??SOTA模型成功率仅40%
MetaAgentX团队推出Open CaptchaWorld平台,用于测试Agent解验证码能力。实测SOTA多模态模型成功率低,如GPT - 4o也被难住。该平台特点多样,揭示了当前Agent短板及模型设计新方向。
Loop Engineering 实战:实现从日志扫描到预发部署的全自主闭环
文章分享 Loop Engineering 实战经验,指出传统维护循环存在看不见、记不住、没闭环问题。介绍了从 Prompt 到 Loop 的四代 AI 工程化范式,阐述 Loop 原理、组件及落地实践,还提及范式迁移和踩坑教训。
如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证
大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。
开源AI开发生态大洗牌:低代码平台逆袭,传统LLM框架日渐式微
第十届527蚂蚁技术日,蚂蚁对现有开源生态全面剖析,发布2025大模型开源生态全景图。分析显示开源生态有三个主导技术赛道,还总结出七大趋势,为从业者提供生态演进规律参考。
Meta把内部设计系统开源了,支撑内部13000+应用,专为Agent调优
Meta开源的Astryx大更新,改造成Agent适配设计系统。它已在Meta内部演进8年,支撑13000+应用,提供150+可访问、可主题化的UI组件及开发工具,让人和AI用同一套语言。
可复制的 AI Coding 全栈实战:比 OpenSpec 更轻量、更丝滑
本文整理自淘宝闪购邓立山在 QCon2026 北京站演讲,分享其团队一年多 AI 编码全栈实战经验,分析 AI 编码问题,提出解决方案,介绍方案演进、实战案例及推广情况,还探讨了未来演进方向。
全国首部AI智能体应用评估标准,现公开征集起草单位和个人!
AI智能体正从辅助向自主决策进化,但企业因缺乏评估规范,面临选型、验收、优化难题。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,公开征集起草单位和个人。
全国首部AI智能体应用评估标准,现公开征集起草单位和个人!
2025年是AI智能体元年,市场规模将达113亿美元,但企业部署面临‘效能黑箱’,缺乏评估规范。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,现征集起草单位和个人。