「实验闭环验证」共找到 2180 篇相关文章
快手 AB 场景提速 145 倍,从 Spark 到 Apache Doris 的加速实践
快手 AB 指标生产场景从 Spark 切换到 Doris 提速 145 倍、资源消耗降 72%,刷新 Doris 单机群最大规模。本文介绍选择 Apache Doris 的原因,以及在存储、计算、调度、稳定性等方面的优化,对构建 AB 实验平台有参考价值。
Claude Code 新功能 Agent Teams:4 类活效率翻倍,4 类活纯烧 token
Claude Code v2.1.32 后新增实验性功能 Agent Teams,可将其从单个 AI 助手升级为 AI 团队,但会使 token 用量线性放大。文章总结了适合和不适合用此功能的任务类型,还给出决策清单、实战避坑建议。
阿里开源PromptEcho:用冻结多模态大模型为文生图训练提供高质量Reward
阿里团队提出PromptEcho方法,无需标注和训练reward模型,仅通过冻结多模态大模型(VLM)的一次前向推理获高质量reward。实验显示其在文生图和电商海报文字渲染任务效果佳,且已开源相关代码等。
生成式推荐补上关键一环!语义ID首次实现可微分联合优化 | SIGIR'26
生成式推荐依赖语义ID,可现有语义ID常先学好再冻结,与推荐目标不一致。论文DIGER首次将可微分语义索引机制引入生成式推荐框架,让推荐损失参与语义ID学习,还设计策略解决训练问题,实验表现佳。
头号玩家照进现实!NTU发布世界模型交互新范式,攻克主动操作难题
南洋理工大学MMLab团队推出Hand2World,让AI世界模型能真正互动。它摒弃旧有遮挡误导,用3D手部结构与射线编码解耦手与头运动,实现闭环持续交互,基于单目视频全自动标注,为AR、机器人交互铺路。
清华开源教育龙虾,沉浸式互动课堂,运行成本仅为传统的千分之一
清华大学团队将校内验证两年的AI课堂系统OpenMAIC开源。它能把主题或文档转化为互动课堂,运行成本仅为传统MOOC的千分之一。有多种组件,多智能体协作,还支持多种大模型,已获学生积极反馈。
准确率提升至 90%,阿里商旅基于 AgentScope 构建多智能体差旅助手最佳实践
阿里商旅依托阿里巴巴生态,旗下AliGo差旅助手可实现业务闭环。早期单智能体模式有瓶颈,后基于AgentScope构建多智能体系统,从技术选型、架构设计等多方面优化,事项收集准确率提至90%+,还解决诸多问题并获奖。
AI祛魅之后:2026年将是AI脱下华丽外衣并穿上工装的一年
2026年AI将从概念验证迈向产业深处,展现实用价值。行业焦点从构建大模型转向让AI好用,还会从依赖算力扩张过渡到研究新架构。小模型崛起、智能体互联标准化、世界模型构建及物理智能落地成趋势。
SIGGRAPH Asia 2025最佳论文 | 港中大、曼彻斯特大学获奖
SIGGRAPH Asia 2025将“最佳论文奖”颁给港中大与曼彻斯特大学团队研究。该研究提出全新切片计算框架,把切片生成与路径规划转化为数学优化问题,解决传统DLP 3D打印难题,还介绍了进阶策略和实验结果。
Gartner发布生成式AI模型提供商魔力象限
Gartner发布《生成式AI模型提供商创新指南》,首次对生成式AI市场进行象限划分,按功能完整性和未来潜力将厂商分为新兴领导者、新兴挑战者、新兴远见者和新兴专家四个区域,还指出AI正从实验转向企业核心层。