端到端学习」共找到 3467 篇相关文章

新闻资讯7

Meta万引强化学习大佬跑路!用小扎原话作为离别寄语,扎心了

Meta万引强化学习大佬Rishabh Agarwal即将离职,用小扎原话“在这个瞬息万变的世界里,最大的风险就是不去冒险”作为离别寄语。他曾参与谷歌、Meta重要模型工作,下一站未明,Meta还有老员工出逃。

量子位
算法论文8

从「找视频」「产视频」:快手RaG推动推荐系统迈向完全生成时代

快手最新论文提出的 Recommendation-as-Generation(RaG),把推荐系统从「在已有视频里找答案」推进「根据用户兴趣生成答案」,已在快手大规模广告系统中部署,带来广告收入提升。

机器之心
算法论文8

信通院&清华提出FedRE:用「纠缠」搞定联邦学习三难困境 | CVPR 26

联邦学习中兼顾模型性能、数据隐私和通信开销是挑战,尤其在模型异构场景。信通院和清华联合团队提出FedRE框架,能适配异构与同构场景,保证性能同时保护隐私、降低开销。

量子位
新闻资讯7

Anthropic融了250亿,却说:AI时代的学习,只剩下这3件事了。

Anthropic估值3500亿,融资超250亿后与哈佛、伯克利学生探讨AI时代学什么。指出AI是照妖镜,能区分混子与学霸,还介绍AI学习法,强调对抗舒适区用AI提升自己。

探索AGI
产品应用7

不做手机缩小版:AI 健康记录迁手腕,要跨过哪些工程鸿沟?

文章聚焦HarmonyOS穿戴应用,如「小卡健康」将健康记录入口移手表,还介绍「开练」「凯格尔运动」应用。阐述了从接口产品需解决权限、断连等问题,强调要为用户提供合适体验。

AI前线
算法论文8

AgentFly:重塑Agent,无需微调LLM,如我们一样的记忆和经验持续学习

现有LLM智能体依赖静态流程或微调参数,缺乏灵活性且成本高。论文提出基于记忆的在线强化学习框架AgentFly,不更新LLM权重,在多基准测试表现出色,为构建通用智能体提供新范式。

深度学习自然语言处理
算法论文8

清华上交满分论文证明:强化学习并不能让大模型更会思考!

清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让大模型更会思考,推理能力上限仍由基础模型决定。

AI工程化
推荐文章8

Loop Engineering 实战:实现从日志扫描预发部署的全自主闭环

文章分享 Loop Engineering 实战经验,指出传统维护循环存在看不见、记不住、没闭环问题。介绍了从 Prompt Loop 的四代 AI 工程化范式,阐述 Loop 原理、组件及落地实践,还提及范式迁移和踩坑教训。

阿里云开发者
算法论文8

谢赛宁团队用RAE实现从8%84%的飞跃,宣告VAE时代结束

谢赛宁团队用RAE新架构将ImageNet图像生成FID刷1.13,宣告VAE组件过时。RAE结合先进表征学习成果与强大生成模型框架,解决诸多问题,还为其高维潜空间定制DiTDH架构,性能优异。

AIGC开放社区
新闻资讯7

传奇黑客首次造出“透明芯片”,从硬件代码全部公开可验证

8月初第34届Defcon黑客大会,主办方发放美籍华裔黑客黄欣国设计的徽章,核心是开源微控制器Baochip - 1x。该芯片从设计制造全开放可验证,用红外原位检测,还集成硬件加固手段,安全性能对标商用元件。

DeepTech深科技