「学习效率」共找到 2457 篇相关文章
10万token自然语言推理,让30B-A3B模型站上奥赛金牌线
上海人工智能实验室报告显示,30B - A3B规模的SU - 01模型不依赖外部工具,经训练在IMO、USAMO、IPhO等奥赛评测达金牌水平。研究还验证更高效科学推理系统路线,有望用于更多科学问题。
多模态大模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26
多模态大模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北大和山大团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。
2篇最新Anthropic论文,揭开LLM对齐新范式
Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。
华创七星微:为直流供电系统筑起一道防火墙
随着AI等领域设备迭代,电源保护重要性凸显。华创七星微依托六类量产芯片和将问世的集成模块,为直流供电系统提供防护,其产品覆盖供电链路关键节点,有完整解决方案,还具备多种能力优势。
【开源】build-your-own-x:30+领域造轮子教程,程序员内功提升指南
开源项目 build-your-own-x 收录 30+ 领域「从零造轮子」教程,解决学编程只知用不知原理的问题。涵盖 3D 渲染、AI 模型等多领域,多语言可选。介绍学习好处、使用方法,还推荐优质教程。
全球自动驾驶激战,滴滴与清华走出一条技术新路
2026年全球自动驾驶竞赛白热化,Waymo高歌猛进,特斯拉遇困境。滴滴与清华合作,成立实验室,发布STAPO算法,打通产学研链路。滴滴自动驾驶低调务实,掌握全栈技术,将出海阿联酋,其主业优势保障稳健发展。
Qoder CLI + Harness Engineering 实战:构建 7×24h 无人值守用户反馈自动处理系统
在 Qoder 产品用户反馈增多、人力处理流程痛点凸显的背景下,构建 7×24 小时无人值守的用户反馈自动处理系统。该系统分四个核心模块,基于 Qoder CLI 实现,显著提升处理效率。
AI提效20%,我们程序员加班却越来越狠:老板量生产力的尺子,歪了?
文章指出 AI 虽提升编码效率,但整体提效有限,企业衡量开发者生产力的指标易走偏。不同行业对 AI 应用态度不同,企业需合理管理 AI 成本,未来人的价值体现在复杂工作中。
实测参考生之王Vidu Q3:这已经不叫AI生成了,这叫AI驱动整个剧组
4月13日生数科技发布视频大模型Vidu Q3,在SuperClue榜单断层登顶。它从‘生成视频’转向‘驱动剧组’,升级后能嵌入内容生产流程,实现‘万物可参,声画同出’,在多赛道表现亮眼。
二元成功率已经过时!PRM-as-a-Judge才是你需要的具身操作评测框架
传统二元成功率评测具身操作任务有局限,难回答策略推进、执行效率等问题。中科院自动化所等机构研究人员提出PRM - as - Judge框架,含进度势能、OPD指标体系和RoboPulse基准,能细粒度审计执行过程。