「速度提升」共找到 3336 篇相关文章
西湖大学提出RDPO强化学习框架,实现扩散模型并行推理加速
扩散模型“顺序去噪”特性成速度提升瓶颈。西湖大学AGI Lab提出RDPO框架,不必改动模型本身,优化其“采样导航系统”,在多基准测试中取得领先图像生成效果,解决加速问题并提供RLHF对齐新范式。
ACL 2025 | GALLa:给代码大模型装上“透视眼”,看懂程序的“骨架”!
蚂蚁集团与上海交大合作的 GALLa 研究被 ACL 2025 主会录用。它利用图神经网络将代码图结构信息注入大模型,在 7 个模型和 5 个任务上提升性能,推理与普通 LLM 一致,不增成本。
机器人的「GPT时刻」来了?丰田研究院悄悄做了一场最严谨的VLA验证实验
丰田研究院(TRI)团队研究大型行为模型(LBM),在近1700小时机器人数据上训练并大量部署评估。发现LBM性能提升显著,预训练小数据量也能带来增益,预示机器人通用大模型或到来。
北大发布学术搜索评测ScholarSearch:难倒一众DeepResearch的“开卷考试”
北京大学DS - Lab发布ScholarSearch,这是评估大语言模型学术检索能力的数据集,含223道高难度题目。评估显示现有模型表现欠佳,纯推理模型准确率低,有搜索功能的模型虽有提升但仍不足。
吴恩达:最快的团队,人人都是产品经理
吴恩达在最新编辑信中指出,AI编程工具提升开发速度后,瓶颈转移到‘决定做什么’。传统团队配比失衡,最快团队让工程师身兼PM和工程师。Claude Code团队实践与之相符,AI时代人人应成通才。
离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器人训练范式
杨硕从特斯拉擎天柱团队离职创业一年多后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器人动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,在人形机器人上有新突破。
VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景
上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。
先说个暴论:不懂代码的人,才最喜欢 Vibe Coding。
文章指出不懂代码的人爱Vibe Coding,还介绍AI Coding赛道跨行、跨文件补全方向。分析基于AST的上下文构造、提升速度的方法,提及AI IDE采纳率问题,认为实际项目中NES可控度更高。
ZeroGPU Spaces 加速实践:PyTorch 提前编译全解析
本文聚焦 ZeroGPU Spaces 加速实践,介绍 PyTorch 提前编译。ZeroGPU 使在 Hugging Face Spaces 用 Nvidia H200 硬件更高效,但有局限。提前编译可优化模型,提升演示速度,还分享了接入方法、高级技巧及演示示例。
斩获5.5K star!!AI 加持到位,安全感拉满,这个升级版开源知识库神器太顶了!
两个月前分享的开源AI知识库项目PandaWiki,迭代速度惊人。此次更新多个大版本,编辑器体验提升,AI成智能客服,支持20+家模型供应商,还优化团队协作功能和诸多细节,更成熟实用。