「指标证据链」共找到 668 篇相关文章
Anthropic 发布第四份人类经济指数报告:AI 对全球工作的影响仍然不均衡
Anthropic发布第四份经济指数报告,提出“经济基元”概念,用五个基础指标衡量AI使用情况。报告发现任务越复杂,AI加速效果越明显,不同国家使用方式有差异,还提及“去技能化”等情况及对生产力的影响。
剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了
剑桥大学等机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。
中国AI芯片迎「华为时刻」
国内AI芯片市场正经历变革,“去英伟达化”成热词。科技巨头推动自研,9月国产芯片捷报频传,性能追赶超越英伟达。这既因地缘政治致供应链风险,也是AI从训练到推理转变下的必然选择。
这次,LLM黑盒被LLM打开了~
随着大语言模型(LLM)能力提升,其内部机制更不透明。概念描述新范式用另一个 LLM 自动生成自然语言解释。介绍了描述对象、生成方法、评估指标,还提及社区关注方向,指出结合多种手段才能把解释变知识。
AI原生产品不等于全部功能AI化,保留传统功能让用户体验更完整 | 对话小卡健康
AI健康管理赛道竞争激烈,产品各有差异。量子位智库访谈小卡健康产品负责人李雅,探讨AI如何赋能、产品功能拓展、数据指标关注、智能设备联动、开发问题及运营推广等,展示其差异化策略和发展思考。
The Batch: 880 | 用 AI 学 2 小时 vs. 跟老师学 6 小时
Alpha School用AI驱动教学,将传统6小时课程替换为2小时个性化学习,让学习速度翻倍,学生考试成绩优异。但部分教育委员会拒绝其分校申请,批评者称缺乏严格证据。此外,美国多地也在进行AI教育尝试。
AI里最大的Bug,却也是人类文明最伟大的起点。
OpenAI论文指出AI产生幻觉是因其训练方式奖励瞎蒙行为。以考试为例,AI在信息不足时猜测是最优策略。还从统计学解释根源,指出解决幻觉需改变评估指标,也引发对人类想象力起源的思考。
设计师大解放!清华发布「建筑平面图」自动生成模型 | ACL'25
清华大学吕帅团队提出FloorPlan-LLaMa模型,采用自回归生成架构与RLHF机制,解决传统平面图自动生成模型‘指标优秀但实际不可用’痛点,提升生成式平面图设计质量与实用价值。该论文被ACL录用获领域主席奖。
从数据分布视角,重新认识下CoT
本文从数据分布视角重新审视大语言模型的思维链(CoT)推理。指出CoT并非真正推理,而是模仿,其效果受训练与测试分布差异影响。通过实验揭示CoT在分布偏移时性能退化,提醒勿过度依赖。
英伟达咽喉上的苏州人
英伟达供应链名单中,英诺赛科意外现身。它从珠海‘三无小作坊’起步,7年吸金60亿,成英伟达中国独家供应商。创始人骆薇薇回国创业,选IDM模式和8英寸工艺,带领公司成全球首量产8英寸硅基氮化镓晶圆企业。