「低功耗场景」共找到 2779 篇相关文章
快手Klear团队提出CE-GPPO:通过梯度保留协调熵,解决强化学习中的熵不稳定问题
快手 Klear 语言大模型团队提出新强化学习算法 CE - GPPO,以「熵」为核心,提出梯度保留策略,重新利用裁剪外区间低概率 token 的梯度,实现策略熵的精细调控,解决强化学习中熵不稳定问题。
智源开源EditScore:为图像编辑解锁在线强化学习的无限可能
北京智源研究院团队发布 EditScore 高保真奖励模型系列,为图像编辑强化学习提供精确奖励信号。团队提出两步解决方案,开发出 EditScore 系列模型,其在多方面表现优异,还验证了两大应用场景,有深刻研究洞见。
三季度,光刻之王“满血复活”,台积电成“AI印钞机”
日前,荷兰光刻机巨头ASML发布三季报,净销售额等数据亮眼,其预计四季度业绩更优,但2026年在华销售额或下降。同时,AI浪潮重塑芯片投资结构,ASML投资Mistral AI。台积电Q3营收、利润暴增,也面临依赖北美市场等问题。
「注意力经济」下,AI 生活助手能否解锁生服「新」刚需?
今年不少国内大厂加码AI生活助手赛道。腾讯、阿里、美团、京东、滴滴等各有动作,如腾讯在微信上线「元宝」,阿里在电商业务开发助手。当前AI应用使用时长和留存率不佳,而助手或能过滤信息、缩短决策链路。
CoT 之后,CoF 如何让帧间逻辑从「隐式对齐」变成「显式思考」?
CoT 虽提升语言模型推理能力,但在 C 端场景有局限,且被质疑并非真实推理。视觉领域提出 CoF 概念,Google DeepMind 团队引入理论,让视频模型通过帧链推理提升帧间一致性,还具强大泛化能力。
西湖大学打造了一个AI科学家,突破人类SOTA,还能自己发论文
西湖大学文本智能实验室推出能自主探索的AI科学家DeepScientist,两周完成人类三年科研量。它在三个前沿AI任务刷新SOTA纪录,还能写论文。文中介绍其科研历史、工作方式、成果及面临的伦理问题。
哈佛CS博士月入4000,抢GPU搞科研!硅谷百万年薪挖人,学界疯狂逃离
AI人才大战使学术界陷入危机,博士生津贴低、抢显卡搞科研,面对硅谷百万年薪和大厂千亿算力投入诱惑,加速流向产业。教授担心学生跳槽,高校补救难,产业还推出“折中方案”,学术界考验才刚开始。
Gaia2 与 ARE:赋能社区的智能体评测
文章介绍 Gaia2 与 ARE,Gaia2 是智能体基准 GAIA 升级版,能分析复杂行为,与 ARE 框架一同发布。ARE 可模拟复杂真实条件,支持定制。文中对比多款模型,指出当前模型挑战,并说明评测步骤和 ARE 使用场景。
中国AI高速路,华为给出开源开放方案
上周华为全联接大会展示系列创新。超节点架构带动的开源开放意义深远,开放硬件、开源软件和灵衢组件。华为发布系列超节点新品,实现全场景覆盖,同时全面开放开源,推动产业协同与生态繁荣。
Nvidia GPU深度解析
文章深度解析Nvidia的B30A(传闻)、HGX H20、H100、B200和B300(Ultra)五款GPU,从架构、性能、内存、封装工艺和应用场景等方面对比差异,助读者选合适GPU。