残差驱动」共找到 949 篇相关文章

算法论文8

用动作分块突破RL极限,伯克利引入模仿学习,超越离线/在线SOTA

如今强化学习在多领域成果显著,但在长跨度、稀疏奖励任务中表现欠佳。加州大学伯克利分校研究者提出Q - chunking方法,将动作分块引入基于时序分的强化学习,解决探索效率和值传播问题,实验表现优异。

机器之心
新闻资讯7

xAI正面临法律诉讼

Techcrunch消息,马斯克旗下xAI因在孟菲斯郊外运营的Colossus数据中心未经许可运行天然气涡轮机面临诉讼。南方环境法律中心指出其未获必要许可,涡轮机或排放大量氮氧化物,孟菲斯空气质量本就

AIGC开放社区
算法论文8

北大发布学术搜索评测ScholarSearch:难倒一众DeepResearch的“开卷考试”

北京大学DS - Lab发布ScholarSearch,这是评估大语言模型学术检索能力的数据集,含223道高难度题目。评估显示现有模型表现欠佳,纯推理模型准确率低,有搜索功能的模型虽有提升但仍不足。

量子位
新闻资讯7

Google搜索转型,Perplexity入不敷出,AI搜索还是个好赛道吗?

Google在I/O开发者大会宣布上线由Gemini驱动的高级AI搜索模式AI Mode,此前其因转型冲击收入而犹豫。Perplexity访问量增但亏损,AI搜索赛道融资减少,大厂抢占空间,产品转垂类,商业化待探索。

Founder Park
算法论文8

MIT & Google | 提出异步并行生成新范式,LLM推理效率大幅提升!

MIT与谷歌团队在研究PASTA中探索异步生成范式,开发标记语言PASTA - LANG,采用双阶段训练流程,设计推理系统。实验显示PASTA平衡性能与质量,有可扩展性,为LLM推理效率优化开创学习驱动新路径。

AINLPer
算法论文8

PITT | 提出PhyT2V框架:让文生视频(T2V)更符合物理规律(CVPR2025)

当前T2V技术迈向推理驱动阶段,物理规律是关键约束。匹兹堡大学团队提出PhyT2V框架,不依赖模型重训练或大规模外部数据,可增强主流T2V模型能力,有低落地门槛和良好泛化性。

AINLPer
新闻资讯7

猫在说什么,AI知道吗?

近几年,结合AI的宠物翻译应用兴起,如MeowTalk。但动物语言研究面临无平行语料的难题。科学家通过记录声音与行为,让AI找模式,再用回放验证。目前AI虽有进展,但离听懂动物还一步。

DeepTech深科技
开源动态7

大神周末开源省token野路子,claude fable5账单砍掉6成

外网大神周末开源插件,将模型上下文等渲染成图片,可让账单降低59% - 70%。原理是图片token只与像素尺寸有关。此前因模型识图能力难落地,fable5证明其极限省钱且效果保留。

探索AGI
算法论文8

ICSE 2026杰出论文 | 突破代码模型真实工程落地瓶颈,北大团队提出SEAlign对齐框架:显著提升软件工程智能体决策质量

现有代码模型在经典基准表现好,但在真实软件工程环境表现。北大金芝、李戈团队提出 SEAlign 框架,通过识别与对齐智能体轨迹关键决策点,提升模型在真实工程任务表现,成果获 ICSE 2026 杰出论文奖。

机器之心
开源动态8

3.6K Star!OpenCode 团队开源宝贝,模型价格、能力、规格一网打尽!

开发AI应用时,模型选择成难题,信息碎片化、不透明让人头疼。OpenCode团队开发的开源项目Models.dev,整合主流模型关键信息,可一站式查询、精确估算成本、对比能力,还提供公开API,社区驱动持续更新。

开源星探