计算效率」共找到 1773 篇相关文章

算法论文7

Meta|提出RECAP,通过动态目标重加权回放,解决RLVR遗忘【文末送书!Agent相关】

近年来,可验证奖励强化学习(RLVR)提升了大模型在多任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标重加权”,保持模型通用能力,提升推理性能,还提高推理效率

AINLPer
开源动态8

AI两天推翻20年工作习惯!Karpathy百行代码开源项目“封神”,AI替你通宵肝研究、战绩可查

特斯拉前AI总监Andrej Karpathy开源autoresearch项目,让AI Agent自主搞深度学习研究。两天内Agent完成276次实验,提升模型训练效率约11%。项目代码极简,未来目标是实现Agent大规模协作,已被开发者社区共建。

AI前线
新闻资讯7

DeepSeek-V3.2被找出bug了:疯狂消耗token,答案还可能出错,研究人员:GRPO老问题没解决

DeepSeek-V3.2虽强且火爆,但被发现存在bug,即浪费token问题。研究者指出这源于GRPO算法的‘隐藏偏见’,虽修正了‘难度偏见’,但‘长度偏见’仍在,官方也承认token效率是挑战。

量子位
算法论文8

天下武功,唯快不破:LLM高效架构最新最全面综述

大型语言模型虽成就辉煌,但训练成本高、推理延迟大,核心问题源于Transformer架构。这篇综述论文首次系统性梳理高效LLM架构创新方案,分类七大类方法,延伸至跨模态应用,为研究者提供‘效率蓝图’。

深度学习自然语言处理
新闻资讯7

Kubernetes 引入后量子支持的 TLS

Kubernetes推出增强功能,通过与KMS插件系统集成的混合密钥交换机制支持后量子密码学,应对量子计算对加密协议的威胁,确保系统能随密码学标准演变灵活适应,此举措符合相关建议。

InfoQ
开源动态8

GitHub一周2000星!国产统一图像生成模型神器升级,理解质量双up,还学会了“反思”

智源研究院发布国产开源统一图像生成模型OmniGen 2.0版本。它增强理解与生成能力,打通多模态生态。玩法简单,技术有创新,还引入反思机制和新基准,推理效率提升,且将全面开源。

量子位
新闻资讯8

史诗时刻!AlphaGo神之一手突现,谷歌AI颠覆科研极限?

谷歌DeepMind推出AlphaEvolve,它取得多项数学成果,如改进4x4矩阵乘法、推进六边形填充问题研究等。它能自我进化,还可优化谷歌计算基础设施,预示人类与AI强大协作循环的未来。

新智元
新闻资讯8

吴恩达:并行 Agent是 Scaling laws 的新方向

吴恩达称并行 Agent 是扩展 AI 新方向。过去 AI 靠数据和计算量提升能力,如今并行 Agent 能在不增加用户等待时间前提下提升效果,虽任务分解有难点,但研究不断涌现。

AI寒武纪
产品应用8

本来今天标题想炸裂一下,飞书没让我用,但确实很炸裂。

作者作为飞书深度用户参加飞书大会,介绍其更新内容。有正式上线的飞书知识问答、补全的AI会议功能,还有新的飞书Aily、飞书妙搭和多维表格新能力,能提升企业管理和协同效率

数字生命卡兹克
新闻资讯7

鹅厂员工都是怎么被AI“糊弄”的?

文章邀请鹅厂同事分享被AI“糊弄”的离谱事件,如AI在发票报销、数学计算、编程问题等方面出错,还会编造不存在的信息,其“系统性可信”假象比单纯答错更危险。

腾讯技术工程