「时间采样」共找到 424 篇相关文章
第六章 Coding优先编的是「过程与约束」,不是「参数」
本章以开面包店类比训练大模型,介绍 AutoResearch 自主实验框架。它将研究生助理工作循环交给 Agent,在固定时间用单一指标判断好坏。仓库获约 64.7K Stars,Karpathy 设计哲学为极简主义与固定约束。
西湖大学提出RDPO强化学习框架,实现扩散模型并行推理加速
扩散模型“顺序去噪”特性成速度提升瓶颈。西湖大学AGI Lab提出RDPO框架,不必改动模型本身,优化其“采样导航系统”,在多基准测试中取得领先图像生成效果,解决加速问题并提供RLHF对齐新范式。
当AI开始设计芯片
英国XMOS芯片设计公司正研发GenAI工具,能用自然语言提示配置Xcore处理器硬件特性。这不仅能重塑芯片设计流程,让不同背景的人参与设计,还推动商业模式从卖硬件转向卖确定性,挖掘芯片“时间价值”。
LennyBot背后:一个价值1600万美元的"高级FAQ"
著名播客主Lenny Rachitsky推出LennyBot,可就其节目内容聊天并导流,背后公司Delphi获红杉1600万美元A轮融资。作者体验后认为它是高级FAQ,分析Delphi商业模式,指出赛道类似千播大战,红杉赌的是时间窗口。
中国首次提出半导体演进新原则:华为“韬定律”5 年内冲刺等效1.4nm制程,麒麟、昇腾将先后落地量产
5月25日,华为何庭波在研讨会上提出“韬定律”,以“时间缩微”替代“几何缩微”。论文展示验证案例,预计2031年高端芯片达1.4nm等效水平,今年秋季麒麟新芯片将首发“逻辑折叠”技术。
想做成好的AI应用,先从把它砍成“一小时版本”开始「吴恩达老师开发心法」
吴恩达老师分享AI开发实用建议,若开发时间有限,应缩减项目范围,直至能在现有时间内完成。如他将“观众模拟器”项目精简,在短时间构建基础版本,获多方面收获。
VLA大模型做长任务总断片?同济KC-VLA用关键帧链给治好了
VLA大模型记性是短板,处理非马尔可夫任务常束手无策。同济大学等提出KC - VLA框架,用关键帧链接赋予机器人全局时间感知能力,还构建了长时序记忆依赖基准测试,实验显示其性能优越。
长程 Agent 越跑越乱?ContextPilot 用细粒度 RL 教会模型主动管理上下文
长程 Agent 推理时,传统方法使上下文臃肿、推理成本高。清华、腾讯等团队提出 ContextPilot 框架,扩展管理工具集、采用新采样和信用分配方法。实验显示其用短上下文获高分,降低推理开销。
ICML 2026 现场|九篇 Spotlight 论文,透视 AI 最前沿
7月7日,ICML 2026正会首日,雷峰网精选九篇Spotlight论文,涵盖生成模型、智能体系统等多领域。如SDEVI框架解决不规则时间序列生成难题,MASpoB让多智能体提示优化可行等。
谢赛宁与Jaakkola团队重磅研究:无数据Flow Map蒸馏
麻省理工学院Tommi Jaakkola和纽约大学谢赛宁团队联合研究,提出无需数据、仅从先验分布采样实现flow map蒸馏的新方法。该方法可规避“教师 - 数据不匹配”风险,在ImageNet实验中表现出色。