「反中位数」共找到 3033 篇相关文章
世界模型+强化学习=具身智能性能翻倍!清华&加州伯克利最新开源
具身智能发展中样本效率成瓶颈,传统无模型强化学习依赖盲目试错。清华与加州伯克利团队提出BOOM框架,通过自举循环机制解决在线规划与策略学习矛盾,实验表现卓越,为具身智能落地提供支撑。
港中文联手美团开源“视觉推理通才”!图像视频10类任务一网打尽
香港中文大学MMLab与美团研究团队开源OneThinker模型,它可覆盖图像与视频十类核心视觉任务,在31项测试中表现出色,还展现泛化能力。研究团队搭建数据集,并引入EMA - GRPO算法提升训练稳定性。
用激光给芯片散热,摩尔定律天花板盖不住了
初创公司Maxwell Labs提出光子冷却法,可将芯片热量转化成光并去除。该方法基于反斯托克斯冷却原理,集成到薄膜芯片级光子冷板。相比传统散热,它效率更高,有望解决芯片散热难题,推动行业发展。
国产AI击败Meta:ReasonRank荣登BRIGHT榜单第一
基于LLM的段落排序方法中,listwise排序虽有优势,但当前重排器难处理复杂推理查询。ReasonRank通过生成推理密集型训练数据及两阶段后训练,赋予listwise重排序器强推理能力,在BRIGHT榜单击败Meta。
ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频
在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。
推理之父走了!OpenAI七年元老离职:有些研究这里没法做
新年伊始,OpenAI研发副总裁Jerry Tworek离职,他是编程和两大核心技术路线奠基者,攻克LLM编程和复杂推理商业化难题。他称想探索在OpenAI难开展的研究。此前已有多位核心人才出走,OpenAI或因商业化与安全问题留不住人。
必看!Sebastian Raschka新博客盘点了所有主要注意力机制
著名AI技术作家Sebastian Raschka发布博客《现代LLM中注意力变体的可视化指南》,回顾近年开发并用于开放权重架构的注意力变体,包括多头、分组查询、多头潜在等注意力机制,还分析各机制特点、应用场景及优劣势。
【栏目对话和访谈】Sebastian 和 Nathan 在 Lex Fridman 播客深度解读 AI 现状:中美竞争、模型对比、规模定律、AGI 时间线
Sebastian 和 Nathan 在 Lex Fridman 播客中,用 4 小时深度解读 AI 现状,涵盖中美竞争、模型对比、规模定律、AGI 时间线等热门话题,还分享了入行建议、工作文化等多方面观点。
全面战胜ReAct!斯坦福全新智能体推理框架,性能提升112.5%
斯坦福和MIT团队推出新AI智能体推理框架ReCAP,在长上下文任务中全面超越ReAct,性能提升显著。它通过独特结构和三大机制解决大模型常见问题,虽成本增加,但在关键任务表现出色,潜力巨大。
JCP | 西北工业大学宋家豪、张伟伟等:FENN:特征增强神经网络求解流体力学领域的偏微分方程
物理信息神经网络(PINNs)求解偏微分方程收敛慢,尤其是流体力学复杂非线性问题。该研究提出特征增强神经网络(FENN),在PINNs输入引入几何和物理特征,提升收敛速度,经正、反及参数化问题验证其有效性。