真实世界测试」共找到 2937 篇相关文章

产品应用8

70万辆车同步升级,背后那套系统藏了六年

超70万蔚来和乐道车主收到最新版世界模型推送更新。蔚来用一套代码覆盖多品牌、多平台、多芯片、多传感器车型,其技术体系复杂,从2020年起搭建,六年未改底层逻辑,如今效果显现。

量子位
新闻资讯8

黄仁勋:Prompt正在过时,Loop才是新范式

黄仁勋称Prompt正在过时,Loop才是新范式。Loop指设计系统让AI自动下指令、验收,不合格重来。Claude Code和OpenAI Codex已围绕Loop落地产品,还给出了实操指南及发展历程。

量子位
开源动态8

人大和微软开源Arbor,一棵假设树突破自主科研新高度

中国人民大学和微软研究者推出Arbor,它将实验挂到假设树,让研究信息跨周期保留。在六道真实研究任务中表现优异,增益超Codex和Claude Code,且成本相当,还能从失败中积累经验。

AIGC开放社区
算法论文7

大模型也需要睡觉!让AI打个盹,醒来更聪明

卡内基梅隆大学和马里兰大学研究发现,大模型处理长上下文易累傻。受人脑机制启发,设计睡眠机制,让模型在上下文窗口快满时打盹,反复咀嚼信息,压缩进长期权重。测试显示,增加“睡眠”轮次能提升深度推理表现。

量子位
新闻资讯8

从卖token到卖结果,这些公司开始让AI背KPI了

当前企业难以衡量AI真实价值,常以调用量代替产出。一批公司开始尝试改写,如Sierra和零犀科技,直接对结果收费。Sierra覆盖超40%财富50强企业,零犀实现规模化盈利与正现金流。

机器之心
开源动态8

终端已死,Agent终端万岁:Warp一天暴涨1.2万星背后的开发者工具革命

4月29日,Warp在GitHub单日涨近12000星,总星数破4万。其定位从普通终端转变为Agent式开发环境,这表明开发者对AI原生终端需求真实且被低估,Agent化已成产品核心竞争力。

AI Reading Hub
推荐文章7

AI Native的组织架构应该是怎么样的?Block CEO:每家公司都可以压缩成一个agent

Block CEO Jack Dorsey 认为传统公司层级制度在 AI 时代已无必要,AI 可承担协调等功能。Block 以 AI 为中心重建公司,构建两个世界模型,搭建四层架构,裁员 40%,重新定义人员角色和 CEO 工作。

Founder Park
产品应用7

OpenClaw的风,已经吹进了奶茶圈

OpenClaw的风已吹进奶茶圈和百货零售行业,古茗和银泰百货测试使用它提效显著,但也遭遇安全风险。直播中专家拆解风险并给出安全落地方案,强调Agent时代安全是企业入场券。

量子位
开源动态8

15个前沿大模型,100个职业场景:谁才是最强AI打工人?

通义千问与港中文联合发布OccuBench,用语言世界模型评测AI Agent职业能力。评测15个前沿模型,发现无全能选手,隐式故障难处理,Scaling定律有效,做Agent和环境模拟器能力不同,还给出具体案例。

AI科技评论
8

刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA

普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。

量子位