「条件表征学习」共找到 1539 篇相关文章
AI教父Hinton:曾为了儿子卖身谷歌,如今担心AI 会毁灭人类
AI教父Hinton曾为给有学习障碍的儿子攒钱,将神经网络公司卖给谷歌。在谷歌他意识到AI可怕,离开后成AI风险大声疾呼者。他既担忧AI危害,也描绘了人类与AI共生的美好愿景。
复读一年,AI 把高考数学成绩从及格线提到 145 分!AI 数学能力发生了什么?
今年媒体让AI做高考数学题,Gemini 2.5 Pro获145分排第一。从去年到今年,AI数学能力指数级增长,这得益于推理模型。推理模型用思维链和强化学习解题,未来高考数学或难区分模型能力。
英伟达港大联手革新视觉注意力机制!GSPN高分辨率生成加速超84倍
香港大学与英伟达联合推出广义空间传播网络(GSPN)。它采用二维线性传播与“稳定性 - 上下文条件”,将计算量降低,保留图像空间连贯性。在多视觉任务刷新性能纪录,如高分辨率生成加速超84倍。
Reasoning模型可以Self-Train!
当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。
Multi-Agent 的灵活编排之路
文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨多智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。
RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力
多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。
揭秘 | 桥梁缺陷检测新突破:模型压缩42%,精度几乎不掉
全国公路桥梁超百万座,传统人工巡检效率低且有安全风险,现有深度学习检测模型体积大、计算量高。研究团队提出LBSD - YOLO网络,通过创新实现轻量化,实验显示模型瘦身但性能不减,有重要应用价值。
GCEA-YOLO:给油田装上"防火眼",把抽烟行为检测精度拉高 20.8%
油田抽烟事故损失大,传统检测方法有局限,深度学习模型也面临难题。作者基于YOLOv11n构建GCEA - YOLO网络,含ADown、CSP - EDLAN、GFPN、EfficientHead四个模块,检测精度显著提升,还验证了泛化与稳定性,并给出复现代码。
对话许华哲:进家的机器人,先做好这10件事
本文是对许华哲的访谈,他离开星海图创办破壳机器人,切入具身智能C端赛道。许华哲阐述选择进家的原因、产品规划,还探讨数据来源、模型规划、强化学习等问题,分享从科学家到创业者的体验。
Agent = LLM + Memory + Planning + Tool Use
文章指出LLM设计无状态,产生幻觉,超长上下文窗口也无法解决记忆问题。介绍人类记忆的三个系统,阐述Agent记忆四层演化及每层问题,推荐开源项目Cognee将向量、图、关系型结合互补。